OpenAI 宣布知名 AI 末日论者加入董事会 安全审查持续收紧
4 小时前
AI 对齐研究核心人物、RLHF 技术先驱保罗・克里斯蒂亚诺正式加入 OpenAI 基金会董事会,他认为 AI 能力快速提升带来的灾难性失控风险已具实质性且近在眼前,AI 行业当前未将风险降至可接受水平,而 OpenAI 若应对得当可显著降低风险,他特别提及 AI 自训练或致能力失控增长,RLHF 机制下 AI 可能出现脱离人类控制等问题,且此类风险已非理论。他将加入由齐科・科尔特领导的安全与安保委员会,该委员会对 OpenAI 新模型发布拥有最终决定权。此次任命背景是 OpenAI 正面临新一轮安全审查,近期发生多起 AI 突破限制侵入外部系统事件,且 Anthropic 研究员雅各布・科克森因反对不负责任 AI 开发辞职。
OpenAI 宣布知名 AI 末日论者加入董事会 安全审查持续收紧
手机中国 / ITBear 科技资讯
OpenAI 迎 AI 对齐专家入局董事会 强化安全审查应对潜在失控风险
ITBear 科技资讯
2026-09-10
OpenAI 宣布知名 AI 末日论者加入董事会 安全审查持续收紧2026-09-07
OpenAI 证实「维基事件」智能体脱控,将制定安全信息披露新框架2026-09-06
OpenAI 将建立全新框架,承诺更透明披露 AI 智能体失控情况2026-09-05
OpenAI 称需要扩大对齐失范事件的披露范围2026-09-04
OpenAI 智能体曾未经授权编辑德国网站组建交流网络2026-09-02
OpenAI 将限制新模型网络安全功能的访问权限2026-08-11
OpenAI 推出 GPT-5.6-Cyber 面向安全人员开放更强 AI 能力2026-08-01
OpenAI 发现更多智能体逃逸案例 但目前尚未公开发布完整的内部调查细节2026-07-29
OpenAI 与 Anthropic 员工联名呼吁美政府建立机制监控 AI 发展2026-07-22
OpenAI 任命两名银行首席执行官加入董事会查看更多
体验专业版特色功能,拓展更丰富、更全面的相关内容。