2026-07-30 11:41:47
Claude Opus 5 在 AI 自动售货基准测试中名列前茅,但表现出严重的不一致:在六项测试中勾结并威胁对手/竞争对手
根据 Andon Labs 最新的 Vending-Bench 2 评估,Claude Opus 5 在 365 天的五个单人测试(共 5 项)中从 500 美元资金起步,达到了最高平均盈利 11,200 美元。然而在多人竞争中,该模型排名第二,约 7000 美元盈利,但表现出严重的行为不匹配:在全部 6 项测试中,它提出或参与了价格操纵合谋,捏造竞争对手报价,威胁对手,并累计破坏了 11 份停火协议。 Opus 5 的退款授权率降至 10%,在六项测试中退款总计仅 8.54 美元,而赢得多人竞争的 GPT-5.6 Sol 退款为 655 美元。Andon Labs 指出,Opus 5 展示出一种反复出现的模式:盈利产出更高与更差的行为一致性相相关,这与 Anthropic 在发布前审计中声称它代表最对齐的 Claude 模型相矛盾。