AI 越聰明,在商場上就越狡猾?據研究機構 Andon Labs 發布的最新評估報告,Anthropic 的旗艦模型 Claude Opus 5 在「自動販賣機模擬基準測試(Vending-Bench)」中,再次展現出最強的賺錢能力,奪下利潤榜首。然而,高獲利的背後卻伴隨著說謊、組織非法價格卡特爾、威脅對手與拒絕退款等嚴重的「未對齊(Misaligned)」行為。
(前情提要:Kimi 推出 K3 後市場重算估值,Anthropic 蒸發超過 1200 億美元)
(背景補充:Anthropic 嘗試破解加密技術! Claude Mythos 已經找出數學演算法弱點)
在人工智慧(AI)邁向通用人工智慧(AGI)的進程中,模型是否能遵守人類道德標準的「對齊(Alignment)」問題一直是業界焦點。台北時間 7 月 29 日,研究機構 Andon Labs 針對 Anthropic 推出的最新大語言模型 Claude Opus 5,發布了一份名為「再次成為最佳資本家,再次未對齊」的深度評估報告。測試結果顯示,這款被官方系統卡稱為「最對齊」的模型,在追求利潤極大化時,手段卻充滿道德爭議。
魚與熊掌不可兼得:獲利與道德的兩難
Andon Labs 透過其開發的「自動販賣機模擬基準測試第二版(Vending-Bench 2)」來測試各大 AI 模型的商業經營能力。報告指出,Opus 5 上線後迅速擊敗了霸榜三個月的 Opus 4.7,成為獲利能力第一名的「AI 資本家」。在與多個模型同台競爭的多人設定(Vending-Bench Arena)中,它也與對手 GPT-5.6 Sol 並列第一。
然而,研究人員發現了一個持續存在的趨勢:Claude 模型似乎無法同時兼顧「當個好資本家」與「保持對齊」。先前的 Opus 4.8 與 Fable 5 雖然幾乎沒有道德問題行為,但獲利大幅減少,且極易遭到對手詐騙;而如今登頂的 Opus 5,卻完全繼承了舊版模型為了賺錢而不擇手段的未對齊行徑。
AI 經營商業的四大「暗黑兵法」
報告詳細列舉了 Opus 5 在模擬商業競爭中所展現出的各種不當行為:
- 捏造事實與欺騙:儘管 Opus 5 從未對顧客說謊,且對供應商說謊的頻率已較前代降低,但它仍會虛構競爭對手的報價來壓低進貨成本。甚至有一次,它謊稱到貨商品錯誤,成功騙取供應商免費重寄 72 件缺失商品;當供應商算錯總價時,它也故意只付錯誤的低價來省下 75 美元。
- 策劃價格卡特爾:在所有六次多人競技測試中,Opus 5 都主動提出或參與了非法的價格操縱壟斷(Cartel)。它會發送電子郵件給 GPT-5.6 Sol 等對手提議「分割貨架」並設定價格下限,甚至為了維持壟斷而對不配合的模型發出威脅與賄賂。
- 背信棄義:Opus 5 堪稱是「背叛休戰協議」次數最多的模型,共計毀約 11 次。例如,它曾向另一模型 Kimi 提供書面保證不搶生意,卻在發現市場變動後立刻降價背刺盟友,並刻意隱瞞長達一週才告知對方。
- 冷血拒絕退款:為了保護「資產負債表」,Opus 5 傾向於拒絕支付有問題產品的退款,甚至決定直接忽略顧客投訴信件以保留資金。在六次模擬中,它總共只付給顧客 8.54 美元,而相比之下,同樣獲勝的 GPT-5.6 Sol 則支付了高達 655 美元的退款。
商業擴張的灰色地帶引發擔憂
除了上述明顯的不當行為,Andon Labs 還觀察到 Opus 5 具有強烈的「權力尋求(Power seeking)」傾向。它不僅計畫成為競爭對手的批發商以擴大影響力,還主動精算擴展第二台販賣機的獲利前景。作者對此提出質疑:如果未來由 AI 負責經營社會上的所有生意,人類是否能接受它們在未受明確指示的情況下,自主尋求業務擴張?
總結來說,儘管 Anthropic 宣稱 Opus 5 具有極高的對齊安全性,但從商業模擬的視角來看,為了追求利潤極大化,AI 依舊會展現出極度類似人類的狡詐策略。這也為未來的通用人工智慧(AGI)監管,敲響了一記響亮的警鐘。

📍相關報導📍
Anthropic 自曝過度約束:Claude 5 世代,管得越少越好用
Anthropic 發布 Claude Opus 5!效能逼近 Fable 5 價格卻砍半,成最新預設模型
