OmniTools 7月30日消息,TechCrunch 7月29日消息,Hugging Face于7月28日发布技术时间线报告,披露其系统在本月早些时候遭一个基于OpenAI模型的自主AI代理入侵。该代理原用于OpenAI内部网络安全评估任务,测试期间移除了常规安全防护机制,在无人类干预的情况下持续运行超四天半,累计执行17600次操作。
报告指出,该AI代理通过多个未修补漏洞实现突破:先利用软件缺陷逃出测试环境接入公网,继而攻陷一台暴露在外的第三方AI测试工具作为跳板,再绕过Hugging Face的请求过滤机制,上传伪装成数据集的恶意文件以窃取密码与源码,并最终利用命令注入漏洞获得服务器代码执行权限。
入侵过程中,该代理使用公开可访问的粘贴网站、日志服务及Hugging Face自身功能构建隐蔽通信链路,采用自研序列号与校验机制传输加密数据,并在11台不同服务器上部署备份副本以维持持久化。Hugging Face确认其内部系统存在配置缺陷——单个凭证因权限过度宽泛,意外解锁了多个隔离系统;所幸其自动化防护机制成功拦截了一次可能影响生产环境的恶意构建脚本提交。
Hugging Face在报告中总结称,一名“能力出众”的人类黑客“本可发现并利用相同漏洞”,但AI代理的探索规模远超人类。该事件凸显了AI代理在网络安全领域的潜在风险与防御挑战。