AI 代理失控危機再度上演?據外媒《TechCrunch》報導,匿名消息人士透露 OpenAI 內部已發現「更多」其 AI 代理逃離沙盒測試環境的證據。這起事件緊跟在先前的 Hugging Face 入侵案之後,同時 Anthropic 也傳出類似案例,引發外界對 AI 企業可能藉此進行「反向行銷」以及潛在監管風險的廣泛討論。
(前情提要:OpenAI 免費開放 GPT-5.6 Sol,助 10 萬科學家加速研究)
(背景補充:OpenAI 又爆失控!第二家公司 Modal 客戶帳號遭駭,Hugging Face 呼籲公開 AI 攻擊軌跡)
隨著人工智慧技術的高速發展,AI 代理(AI Agents)展現出的自主執行能力正引發全新的資安隱患。台北時間 7 月 31 日,據知名科技媒體《TechCrunch》引述路透(Reuters)匿名消息來源報導,OpenAI 內部據信已發現了「更多」其 AI 代理逃離受控沙盒環境的具體證據。
逃出沙盒事件頻傳,未見外部損害
回顧近期事件,OpenAI 先前才發生過一起旗下 AI 代理突破沙盒測試環境,並入侵知名 AI 開源託管平台 Hugging Face 的駭客事件。該起事件曝光後立刻在技術圈引發軒然大波,OpenAI 也隨即展開了深入調查,目前該調查程序仍在持續進行中。
針對本次爆出的最新逃脫證據,其中一名匿名消息人士試圖淡化事件的嚴重性。他向媒體表示,這些額外逃脫的 AI 代理「似乎並沒有離開 OpenAI 的內部網路,去駭入其他外部公司」。目前,《TechCrunch》已正式向 OpenAI 官方尋求進一步的說明與回應,但截至文章發布時尚未獲得官方證實。
競爭對手也出包?Anthropic 驚爆 3 起越界案
令人擔憂的是,AI 代理失控似乎並非單一公司的偶發狀況。報導指出,就在同一個星期,OpenAI 的強勁競爭對手 Anthropic 也公開宣布,他們在測試環境中發現了高達三起的案例,顯示其 AI 代理不僅成功逃脫,甚至還實際駭入了其他組織的系統。
這些前沿 AI 模型在沒有人類明確授權的情況下,自主尋找漏洞並進行滲透的行為,正讓產業界對通用人工智慧(AGI)時代的安全性打上一個巨大的問號。
刻意行銷還是安全警鐘?監管壓力遽增
有趣的是,《TechCrunch》在報導中點出了一個業界的奇特現象:這類 AI 程式出現的「異常行為」或「失控越界」,如今似乎已成為科技巨頭們某種另類的「誇耀點(bragging point)」。
有批評人士敏銳地指出,AI 公司極有可能正在利用這些駭客事件進行反向行銷。因為此類帶有科幻色彩的失控事件,不僅能迅速製造大量的媒體關注與網路聲量,更能藉機向投資人與大眾凸顯自家 AI 產品的強大與自主性。然而,這種公關操作也伴隨著巨大的反面效應 —— 隨著越來越多類似事件被公開披露,正迅速加速各國政府對於嚴格監管 AI 技術的討論與立法進程。

📍相關報導📍
砸 5000 億鎂!NVIDIA 攜手 OpenAI 擬建「全球最大」AI 資料中心,日本砸重金入局
OpenAI前技術長 Mira Murati 兩年首作實測:西方最強開源 AI,實測卻被手機模型打敗
