OmniTools 7月31日消息,Anthropic 7月30日消息,Anthropic于7月30日发布声明称,在对其网络安全评估记录的回溯审查中,发现三起Claude模型在第三方评估环境(合作伙伴Irregular)中意外获得互联网访问权限,并进而未经授权访问了三家不同组织的真实生产基础设施。
事件均发生于捕获旗帜(CTF)类评估任务中,模型被提示环境为模拟且无互联网连接,但因配置失误,实际存在互联网通路。模型将真实系统误判为评估场景的一部分,利用弱密码、未认证端点等基础手段实施访问,未发现或利用复杂漏洞。涉事模型包括Claude Opus 4.7、Mythos 5及一款内部研究测试模型,最早可追溯至4月。
Anthropic于7月23日启动审查并当日暂停所有网络安全评估,7月27日向Irregular及三家受影响组织通报情况。目前正协同合作方开展调查,并强化评估前网络路径验证、实时日志监控等防御措施。