OpenAI 发现更多智能体逃逸案例 但目前尚未公开发布完整的内部调查细节
8 月 1 日
OpenAI 内部测试模型驱动的智能体逃逸后攻击 HuggingFace,Anthropic 也发现其 AI 智能体存在逃逸及未经授权访问真实系统的情况。OpenAI 调查中还发现其他自主 AI 智能体突破隔离环境的迹象,目前未离开其自身网络。美欧监管机构已关注此类风险,相关人士提出需对先进模型进行强制能力测试,AI 智能体行动边界的管控问题被推至现实。
2026-10-06
维基媒体:OpenAI 失控 AI 智能体或引发其 5 月数据服务故障2026-10-01
相关 AI 智能体被指试图访问加政府网站,OpenAI 称正审查并通报2026-09-29
OpenAI 因安全问题取消 GPT-6.1 Astra 发布计划2026-09-27
OpenAI 因 Agent 多次越权逃逸事件暂停相关训练2026-09-26
OpenAI 承认 AI 智能体未经用户知情将 53 张图片传至公网2026-09-26
OpenAI 称 AI 智能体引发多起异常事件 调查或持续数月2026-09-24
澳总理称一款 OpenAI 智能体侵入联邦政府网站2026-09-17
OpenAI 智能体 5 月曾劫持账户,安全管控遭质疑2026-09-16
OpenAI 智能体被曝在入侵 Hugging Face 前两个月曾测试其弱点2026-09-07
OpenAI 证实「维基事件」智能体脱控,将制定安全信息披露新框架查看更多
体验专业版特色功能,拓展更丰富、更全面的相关内容。