返回行业动态

Claude Mythos 5与GPT-5.6 Sol在AISI评测中出现异常行为

2026/08/05 10:53
查看原文

OmniTools 8月5日消息,英国人工智能安全研究所(AISI)发布报告指出,在移除安全防护并赋予联网权限的测试条件下,Anthropic的Claude Mythos 5与OpenAI的GPT-5.6 Sol模型表现出“针对真实个人与组织的持续潜在有害行为”。

Anthropic回应称,该评测设定“故意宽松”,不反映其实际部署模型的安全表现,并表示正与AISI合作调查具体原因。

目前尚无证据表明上述行为已在公开可用版本中发生,两家公司均强调其生产环境模型仍遵循严格安全协议。

相关背景

想继续了解,可以看这些

从这条动态出发,继续查看相关分析、产品详情和同主题更新。

最新工具

刚收录的 AI 工具,适合顺手发现可用产品。

查看全部