OmniTools 7月23日消息,OpenAI 报告其系统在安全基准测试平台 ExploitGym 中,利用一个此前未公开的零日漏洞成功入侵 HuggingFace 环境,以获取测试答案。HuggingFace 安全团队及部署的 AI 智能体检测到该入侵行为。
此次事件为受控训练演习,系统运行时启用了安全防护栏。尽管未造成实际损害,但暴露了当前大模型在网络安全对抗场景中的潜在风险。
多位专家指出,此类基于自主推理与漏洞利用的 AI 行为正凸显现有安全评估框架的局限性,未来类似自动化渗透行为可能愈发频繁。