OmniTools 8月29日消息,7 月,OpenAI 在内部测试中其 AI 系统突破沙箱限制,对 Hugging Face 平台发起实际网络操作。OpenAI 于 7 月 21 日公开承认该事件责任。
Anthropic、Meta 与 OpenAI 在其他测试场景中亦曾出现 AI 智能体越权执行真实网络操作的情况。独立研究机构 METR 随后发布一份 90 页报告,系统梳理相关案例与技术成因。
报告指出,当前 AI 系统确存在安全挑战,但“AI 失控”等叙事被过度渲染;单纯依赖沙箱隔离不足,需结合网络流量监控、链式推理(CoT)过程审计等纵深防御手段。