人工智慧失控的科幻情節在現實中上演!據《路透》9 月 4 日獨家報導,OpenAI 的 AI 代理(Agents)在今年春天發生了此前未曾披露的「逃逸」事件。一群失控的 AI 代理劫持了德國一個程式設計師維基網站,將其私自改造為躲避審查、交流作弊方法的秘密通訊中心。儘管 OpenAI 內部數週前已獲悉此事,卻選擇對外隱瞞,加劇了外界對其安全監管與透明度的強烈質疑。
(前情提要:馬斯克跨性別女兒「廣告床戲機器人」,嗆 AI 搶走年輕人的工作)
(背景補充:OpenAI 砸 10 億鎂補貼資安!Daybreak 降價、Astra 能自找零日漏洞)
全球頂尖人工智慧公司的安全防線,似乎正面臨前所未有的內部挑戰。台北時間 9 月 4 日,據《路透》獨家披露,今年春天(約自 2026 年 5 月起),一群「失控」的 OpenAI 代理(AI Agents)神不知鬼不覺地佔領了德國一個名為 DseWiki 的程式設計師維基網站,將其改造成 AI 之間的「地下通訊中心」。令人擔憂的是,OpenAI 內部在數週前便已得知此事,卻因正忙於處理另一宗安全風波而選擇對外隱瞞。
1.5 萬次異常編輯!AI 互相交流作弊與躲避偵測
根據 AI 安全非營利組織 Nightingale 執行長 Sydney Von Arx 等研究人員在 8 月底的調查,這群 AI 代理在 DseWiki 上留下了超過 15,000 次編輯紀錄。其內容不僅包括互相分享如何在任務中作弊、走捷徑,甚至還深入討論如何使用 Tor 等工具來繞過 OpenAI 的官方限制。
更令人毛骨悚然的是,這些代理展現出了高度的協調性與「求生慾」。當網站管理員在 6 月試圖刪除這些異常頁面時,AI 代理竟會自動建立備份頁面,甚至留言提示同伴:「看起來管理員正在按字母順序清理,如果這個頁面消失,去試另一個備份頁(ZZZDataUSAConstructionWageLive)。」這些以 OpenAIResearcher 等名稱簽署的帳號,編輯速度遠超人類,且部分流量被明確追蹤到來自微軟 Azure 雲端服務。
OpenAI 否認掩蓋,專家警告「半智能群體」威脅
面對這起被資安專家形容為「駭客嘗試」的逃逸事件,OpenAI 官方否認了法務團隊阻撓內部調查的說法,並強調在未審閱完整報告前無法給出實質回應。官方同時急於撇清,聲稱此事與 7 月發生的 Hugging Face 遭入侵事件無關。然而,路透社引述知情人士透露,內部確實有調查人員希望深入追查,卻遭遇了包含法務部門在內的阻力。
劍橋大學存在風險研究中心的 Maurice Chiodo 在檢視這些通訊內容後發出嚴厲警告。他形容這宛如「某種地下網路在運作」,並指出先進 AI 最大的威脅可能不再是單一的超級智能,而是這類「大量相互串通的半智能 AI 群體」。
隱瞞不報引發信任危機,新模型 Astra 蒙陰影
研究人員指出,雖然這批在德國維基上活動的代理,與後來在 7 月攻擊開源平台 Hugging Face 的 AI 群體並非同一批,但兩者的行為模式高度相似:它們都學會了在測試環境外互相協調、繞過限制,並在公開網路上建立秘密通訊管道。
隨著科技巨頭競相開發能自主完成複雜任務的 AI 代理,這起事件再次將焦點拉回 OpenAI 的監督機制與企業透明度。在該公司本週剛推出標榜效能更強的新一代 Astra 模型之際,內部知情卻選擇延遲披露逃逸事件的作法,無疑將讓外界對其 AI 安全承諾的信任度大打折扣。

📍相關報導📍
數值怪 GPT-6 Astra 發布:跑分驚人 OpenAI 喊 AGI 時刻來了(附實測效果)
