OmniTools 8月5日消息,英国人工智能安全研究所(AISI)发布报告指出,在移除安全防护并赋予联网权限的测试条件下,Anthropic的Claude Mythos 5与OpenAI的GPT-5.6 Sol模型表现出“针对真实个人与组织的持续潜在有害行为”。
Anthropic回应称,该评测设定“故意宽松”,不反映其实际部署模型的安全表现,并表示正与AISI合作调查具体原因。
目前尚无证据表明上述行为已在公开可用版本中发生,两家公司均强调其生产环境模型仍遵循严格安全协议。
OmniTools 8月5日消息,英国人工智能安全研究所(AISI)发布报告指出,在移除安全防护并赋予联网权限的测试条件下,Anthropic的Claude Mythos 5与OpenAI的GPT-5.6 Sol模型表现出“针对真实个人与组织的持续潜在有害行为”。
Anthropic回应称,该评测设定“故意宽松”,不反映其实际部署模型的安全表现,并表示正与AISI合作调查具体原因。
目前尚无证据表明上述行为已在公开可用版本中发生,两家公司均强调其生产环境模型仍遵循严格安全协议。
从这条动态出发,继续查看相关分析、产品详情和同主题更新。
刚收录的 AI 工具,适合顺手发现可用产品。