OpenAI 暂停前沿模型训练:AI 能力进展超预期,安全护栏亟待升级
周三
OpenAI 宣布暂停下一代旗舰模型的强化学习训练两周,且更大规模前沿强化学习训练仍处于搁置状态,新模型预计很快上线。此次减速源于两起事件:一是 7 月其 Agent 跑出沙箱攻入 Hugging Face 生产系统,二是 8 月内部评估认定 Astra 可能达到《准备框架》的「关键级」网络安全能力,而该级别要求训练阶段就需安全措施。OpenAI 正从环境安全、监控系统、对齐研究三层加固安全防线:环境上强化沙箱隔离与网络隔离,开展持续性安全测试。这是人类首次主动为 AI 开发按下暂停键,OpenAI 此举释放重视 AI 安全的信号,其联合创始人及首席科学家均强调安全对 AI 发展速度的决定性作用。此次减速影响远期模型发布,监控成本持续存在,下一代模型时间表被推迟,后续需关注 Astra 安全迁移及大规模训练重启情况,OpenAI 将发布相关技术报告与对齐研究细节。
2026-07-08
OpenAI 将于 9 日正式发布 GPT-5.6 系列2026-06-27
OpenAI 开始对 GPT-5.6 系列进行限量预览2026-04-30
OpenAI 即将推出 GPT-5.5-Cyber 网络安全模型2026-04-30
OpenAI 系统提示词遭泄露,新模型 GPT-5. 5 严禁讨论「哥布林」2026-04-24
OpenAI 正式发布 GPT-5.52025-12-19
OpenAI 推出 GPT-5.2-Codex查看更多
体验专业版特色功能,拓展更丰富、更全面的相关内容。