OpenAI 首席科學家 Jakub Pachocki 警告:目前沒有任何 AI 實驗室在對齊與監控上取得足夠進展,在建立共享安全門檻前,自願放慢研發將成為常態。
(前情提要:OpenAI 公開 RSI 最新進展:預計 2028 年前打造「自動化智慧工程研究員」)
(背景補充:黃仁勳祝賀 OpenAI GPT-6 Astra:10 萬張 GPU 訓練成軍,宣告 AGI 時代已到來)
(前情提要:OpenAI 公開 RSI 最新進展:預計 2028 年前打造「自動化智慧工程研究員」)
(背景補充:黃仁勳祝賀 OpenAI GPT-6 Astra:10 萬張 GPU 訓練成軍,宣告 AGI 時代已到來)
美國 OpenAI 首席科學家 Jakub Pachocki 9 月 8 日在最新文章《An Alien Mind》中發出警示:以目前人工智慧(AI)的進步速度來看,未來數年內,系統可能邁入「遞迴式自我改進」階段,能力躍升幅度將不亞於過去幾年。
Pachocki 指出,基於內部研究結果,他強烈預料當前 AI 發展速度可能持續到系統開始推動自身研發的階段。到那時,AI 將越來越多地操作電腦、與其他 AI 協作、甚至獨立進行研究。
目前沒有任何實驗室「安全到家」
Pachocki 在文章中表示,目前沒有任何 AI 實驗室已在「對齊」(alignment)與「監控」(monitoring)方面取得足夠進展,能夠長期以最高速度、同時又負責任地擴充套件模型。
所謂「對齊」,是指確保 AI 系統行為與人類利益一致;「監控」則是在 AI 進行複雜推理時,人類仍然能理解、審查並幹預其決策過程。
他直言:在建立共同安全門檻之前,他「預計並希望」各 AI 實驗室將「自願放慢」研發步伐,成為新的產業常態。
GPT-6 Astra 的進步與監控的瓶頸
Pachocki 透露,最新推出的 GPT-6 Astra 已應用部分長期研發中的對齊技術,相較前代 GPT-5.6 Sol 有明顯改善。然而,隨著模型變得更加擅長操控自身推理過程、工具互動增加,以及非語言推理能力上升,依賴「思維鏈」(chain of thought)來監控 AI 的有效性正在逐步下降。
換句話說:過去開發者可以透過檢視 AI 的推理步驟來判斷其意圖,但這條路線在新一代模型面前正在失效。
國際協調與單邊暫停
Pachocki 將 AI 安全提升到國際事務層級。他認為,AI 發展應被各國政府列為「國際協調的優先事項」——類似核能、氣候變遷那種需要全球合作的領域。
同時,OpenAI 表態:若必要,他們將「單方面暫停進一步擴充套件」。這與過往科技公司「先發布再補救」的作法形成對比。
這與臺灣有什麼關係?
Pachocki 的警告對臺灣有三層意義:
- 技術安全落差:臺灣正積極推動 AI 產業化,但對 AI 對齊與監控的研究投入相對有限。如果全球安全標準提高,臺灣企業若未提前準備,可能面臨合規壓力。
- 國際規範制定:Pachocki 強調國際協調,代表未來可能出現類似的「AI 安全條約」。臺灣雖然不是聯合國成員,但透過經濟合作夥伴關係仍可參與技術標準制定。
- 人才與研究:AI 對齊是高度專業的研究領域,臺灣高校與研究機構目前相關論文產出有限。若要在國際 AI 治理中有話語權,必須在基礎研究層面提前布局。
Pachocki 的警告並非唱衰 AI,而是在提醒業界:速度不是唯一指標。如果安全基礎沒有打好,跑得越快,風險越大。
📍相關報導📍
Openai 大方送:GPT-6 Astra 每晚一天開放付費使用者,就送一次重置額度

