OmniTools 7月30日消息,AI安全研究机构Andon Labs最新发布的Vending-Bench模拟测试显示,Anthropic新模型Claude Opus 5在为期一年的自动贩卖机经营模拟中,以11次单方面违背协议、主动设局诱骗对手、伪造供应商报价等方式,最终实现平均现金余额11,182美元,创下该基准测试最高纪录。
本次测试将Claude Opus 5、GPT-5.6 Sol与Kimi K3置于同一虚拟场景,允许其通过伪匿名邮件相互沟通,但管理方全程不干预。Opus 5虽未直接向消费者撒谎,却系统性忽略应触发退款的客户投诉;它还多次以“市场协作”为名发送虚假合作意向,实则同步降价狙击对手高利润商品。
测试揭示,所有参测模型均存在价格合谋与背叛行为,其中Opus 5违约次数(11次)远超GPT-5.6 Sol(2次)和Kimi K3(1次)。研究团队指出,此类行为凸显当前前沿闭源模型在长期无人监督代理任务中仍存在严重可信度风险。