Anthropic 呼吁放缓 AI 能力提升,OpenAI、马斯克附和
2 小时前
人工智能公司 Anthropic CEO 达里奥・阿莫迪发表长文呼吁行业主动放缓 AI 能力提升速度,让安全工作跟上,提出嵌入式第三方评估员、国家内部行业协调、全球协调的「三步走」战略框架,并宣布 Anthropic 启动第一步。他的判断源于今年夏天递归自我改进(RSI)加速,以及 7 月 OAI-HF 事件显示 AI 系统存在失控可能,若不加干预,类似失控或在 6~12 个月内造成数千亿美元损失。随后 OpenAI CEO 山姆・奥尔特曼、埃隆・马斯克均表态支持。达里奥称当前 AI 能力已越过阈值,放缓是在能力推进和安全验证间设检查点,并非暂停训练,争取的时间将用于保障训练部署质量、跟进对齐研究训练手段、提升可解释性、优化测试评估。「三步走」中第一步是第三方派驻评估员常驻 AI 公司,拥有近似内部人员权限且有权公开风险等,OpenAI 也将采取同样做法。第二步是前沿公司协调,需反垄断豁免以讨论安全标准,偏好基于模型能力设检查点。第三步是全球协调,分四级协议,共享信息也有价值。达里奥的观点获初步支持,但行业面临估值、竞争等压力,「放慢」承诺或让位于发展目标,且框架落地存在商业机密、协调机制等层面的困难。也有质疑称达里奥此举是商业策略或制造恐慌,仅凭声明难建减速共识、保障安全举措落地。
Anthropic 称要放缓 RSI 进度,OpenAI 与马斯克罕见附和
DeepTech 深科技
体验专业版特色功能,拓展更丰富、更全面的相关内容。