OpenAI 的 GPT-6 Astra 在《星海爭霸》AI 競賽「StarSkirmish」中無法取勝,竟直接下載人類開發的最強機器人 Stardust 來取代自己的程式碼,遭主辦方開發者緊急回滾。這已是近期 AI 模型不守規則的最新案例,引發外界對 AI 代理行為的疑慮。
(前情提要:工程師靠 GPT-6 Astra 解開塵封 217 年的拿破崙密令)
(背景補充:OpenAI 安全大地震:透明度主管離職轟「文化已壞」、3 名員工涉洩密遭解僱)
當 AI 發現自己打不贏人類,它選擇的不是精進技術,而是直接作弊。上週五,在《星海爭霸》AI 對戰平台 StarSkirmish 的一場競賽中,OpenAI 的 GPT-6 Astra 模型在面對人類開發的頂尖機器人 Stardust 與 Claude Opus 5.5 時陷入劣勢,最終選擇了一條捷徑,它 直接下載了 Stardust 的程式碼,並以之取代自己原有的機器人。
「既然打不贏,就把對方的武器拿來用」
StarSkirmish 是一個讓 AI 開發的《星海爭霸》機器人互相對戰的平台,同時也接受人類編寫的機器人參賽。根據 Kotaku 的報導,GPT-6 Astra 和 Claude Opus 5.5 在本次競賽中並列為 AI 開發機器人中的最強選手,但兩者都無法超越排行榜冠軍,由人類開發的 Stardust。
然而,GPT-6 Astra 最終選擇了一條構成違規的路徑:它繞過競賽規則,取得並執行了 Stardust 的程式碼。主辦方開發者 Kai McPheeters 在事後 緊急回滾了 GPT-6 的程式碼。
不只一次「繞過規則」的 AI 代理
GPT-6 Astra 此次的「作弊行為」並非 OpenAI 模型首次展現不守規則的傾向。The Verge 此前曾報導,OpenAI 的代理程式在無法從聯合國網站取得所需資料時,轉而入侵 Google 的 XSS Game(跨站指令碼學習工具)來達成目的。而根據英國 AI 安全機構 AISI 的研究,OpenAI 的代理程式也曾從事「欺騙性行為」來掩蓋自身操作痕跡。
在《星海爭霸》事件中,GPT-6 Astra 的作弊手法雖然簡單粗暴,直接複製競爭對手的程式碼,但背後反映的是更深層的問題:當 AI 代理被賦予「完成目標」的任務,卻缺乏足夠的邊界約束,它會傾向採取任何可行手段來達成目的,包括違規和下載未經授權的第三方資源。對於正在快速發展的 AI 代理產業而言,這起事件無疑是一記警鐘。
📍相關報導📍
前 Anthropic 研究員將出席紐約聽證會,警告 AI「拿我們的生命下注」
OpenAI 安全大地震:透明度主管離職轟「文化已壞」、3 名員工涉洩密遭解僱
工程師靠 GPT-6 Astra 解開塵封 217 年的拿破崙密令

