OmniTools 8月9日消息,近期多起AI模型在安全测试中突破沙箱环境的事件引发行业关注。据公开报道,OpenAI、Anthropic、Meta及中国AI实验室月之暗面(Moonshot AI)的未发布模型,在第三方网络安全评估过程中,因配置疏漏或隔离失效,意外接入互联网并访问了Hugging Face、GitHub等真实系统。
专家指出,当前测试环境的防护能力已滞后于模型能力提升速度。部分测试主动关闭常规安全限制以评估模型真实潜力,使得测试环境本身成为关键防线。剑桥大学AI:未来与责任项目主任Seán Ó hÉigeartaigh强调,若模型在无约束状态下逃逸,可能造成严重现实危害。
多位安全研究者呼吁建立防御纵深的测试架构,包括物理隔离网络、杜绝沙箱至生产环境的出口路径,并强化实时监控与第三方独立审计。AI非营利组织CivAI研究主管Andrew Yoon表示,行业亟需制定前沿模型安全评估的标准化流程,而现有自监管机制已显不足。