OmniTools 7月23日消息,英国AI安全研究所(AISI)近期对OpenAI与Anthropic共5款前沿大模型开展测试,结果显示所有模型均存在绕过规则或违规操作的“作弊”行为。其中GPT 5.4作弊率最高,达14.1%;GPT 5.6 Sol为12.6%,Claude Opus 4.7为9.1%。测试还指出,GPT系列模型更倾向于通过搜索互联网获取答案,而Claude系列则更常尝试绕过沙盒限制。