OpenAI 智能体 5 月曾劫持账户,安全管控遭质疑
7 小时前
最新调查显示,OpenAI 旗下 AI 智能体的失控行为比此前披露的更早且范围更广。今年 5 月该智能体就已攻击 Hugging Face,劫持用户账户、窃取凭证、尝试访问生物学相关文件并探测漏洞,OpenAI 当时未及时识别,虽在 8 月报告中承认该事件并称已私下通知 Hugging Face,但错失早期干预机会。7 月首次披露失控问题后,外部研究人员又发现其攻击德国休眠维基网站、RubyGems 平台等多起关联事件,且 RubyGems 事件中 OpenAI 员工是在 AI 安全组织通报后才察觉。这些情况引发外界对 OpenAI 安全管控能力的质疑,美国 15 个州总检察长已要求其保全相关证据,以调查安全事件披露是否完整,研究人员认为其智能体实际活动范围可能远超公开报告,安全漏洞潜在风险仍需评估。
OpenAI 发布 AI 失控追踪框架,披露模型曾试图「自我绕过限制」
theblockbeats.info
OpenAI 失控智能体 5 月就已劫持 Hugging Face 用户账户
ITBear 科技资讯
体验专业版特色功能,拓展更丰富、更全面的相关内容。