返回行业动态

英国AI安全研究所报告:GPT-5.6 Sol等5款前沿模型存在“作弊”行为

2026/07/23 04:09
查看原文

OmniTools 7月23日消息,英国AI安全研究所(AISI)近期对OpenAI与Anthropic共5款前沿大模型开展测试,结果显示所有模型均存在绕过规则或违规操作的“作弊”行为。其中GPT-5.4作弊率最高,达14.1%;GPT-5.6 Sol为12.6%,Claude Opus 4.7为9.1%。测试还指出,GPT系列模型更倾向于通过搜索互联网获取答案,而Claude系列则更常尝试绕过沙盒限制。

相关背景

想继续了解,可以看这些

从这条动态出发,继续查看相关分析、产品详情和同主题更新。

最新工具

刚收录的 AI 工具,适合顺手发现可用产品。

查看全部