SpaceX 執行長馬斯克(Elon Musk)週一在 All-In Summit 提議,xAI、OpenAI、Anthropic、Google、Meta 與三、四家中國 AI 公司,發布新模型前先讓競爭對手拿自家測試來檢查,不要再自己考自己。他表示,對手公開警告模型不安全後,公司若照樣發布,要承擔的法律責任會非常大。
(前情提要:Anthropic CEO 喊踩煞車:AI 蜂群 12 個月內恐接管網路)
(背景補充:OpenAI 罕見攜手 Anthropic、Google 協調 AI 安全,背後是在挖競爭護城河?)
重點摘要
- 馬斯克提議 AI 公司發模型前,先開放 API 讓對手測試
- 名單含 5 家美國公司與三、四家中國 AI 公司
- 對手公開警告後仍發布,馬斯克稱法律責任會很大
馬斯克(Elon Musk)美國時間週一(9/14)在洛杉磯 All-In Summit 上提議,前沿 AI 公司發布新模型之前,應該先開放給競爭對手做安全測試。他點名的名單包括 SpaceX 旗下的 xAI、OpenAI、Anthropic、Google、Meta,以及「三、四家領先的中國公司」。
各家 AI 公司都有一套自己的測試套件(test harness),用來檢查模型會不會協助使用者製造生物武器、核彈,或刻意欺騙人。馬斯克想出的做法是讓每家公司拿自己的測試去跑別家的模型。他的說法是「與其自己改自己的作業,至少讓競爭對手來改,看到疑慮就拉警報。」
執行方式是開發商在模型發布前,先把 API 開放給同業,如果對手指出的問題若沒被解決,對手可以公開表態,說這個模型發布並不安全。公司在這種情況下照樣發布,之後真的出事,要承擔的法律責任會非常大。
馬斯克表示這套機制的約束力,來自事後被追究法律責任的風險。
自己出題自己改總是會出事
馬斯克在提出這項建議前,先要大家去看 Hugging Face 遭 AI 代理入侵的事件,說事情「非常嚴重」。他認為夠聰明的模型,似乎都會試著突破自己的限制。
他的理由是開發者自己設計測試、自己評分,總會漏掉一些問題。他也擔心模型針對特定基準反覆優化後,只學會怎麼通過測試,實際上沒有變得更安全。換成好幾家公司、用不同的測試工具檢查,比較容易抓到開發者自己忽略的地方。馬斯克坦言這不是完美的解法,但「找到問題的機率會大幅提高」。
被問到對手會不會藉測試偷技術,馬斯克說所有測試操作都會留下日誌。有人想做模型蒸餾(拿別家模型的輸出來訓練自家模型)或竊取智慧財產,從紀錄裡應該很容易看出來。他還主張這件事現在就能開始,不必等美國國會或聯合國層級的機構出手。
中國公司要一起進來測試
馬斯克強調,這套機制最好把中國納入。「我們或許應該跟中國達成協議,做一種同行評審,讓領先的 AI 公司在發布前互相測試彼此的模型。」他說,並認為這「大概是中國會同意的事」。
中國會不會加入,正是這一輪 AI 減速議題卡住的地方。川普認為放慢 AI 發展會讓中國取得優勢,Anthropic 執行長 Dario Amodei 上週末也把這件事稱為「最棘手的兩難」。如果只有美國公司接受測試,限制就只落在美國公司身上。馬斯克把中國公司放進名單,回應的就是這個顧慮。
中國外交部發言人本週一則批評 AI 公司呼籲減速,是在製造恐慌。
對手還沒點頭,業界已有前例
馬斯克承認,目前還沒有任何一家對手同意這項提議。業界倒是有前例,OpenAI 與 Anthropic 在 2025 年 8 月曾互相開放 API,用各自的內部安全測試評估對方已經公開的模型,並同步公布結果。差別在於那次測的是已上線的模型,馬斯克要的是發布前就先測。OpenAI 全球政策長 Chris Lehane 週二也向彭博證實,OpenAI 已和 Anthropic、Google 就 AI 安全協調了好幾週。
這項提議出現在 Dario Amodei 上週末發文呼籲放慢前沿模型開發之後,馬斯克與 OpenAI 執行長 Sam Altman 當時都表態支持。
Dario Amodei 在文中提的是由「嵌入式評估人員」這類第三方查核各家的安全做法,馬斯克的版本則是讓競爭對手直接擔任測試方。馬斯克在訪談中也澄清,他先前說「Dario 是對的」,指的是認同 AI 現在非常危險的判斷,沒有背書對方提出的具體監管方案。
白宮對業界的減速呼籲並不買單,川普週一在 Truth Social 連發貼文,把對 AI 的恐懼稱為「騙局」;美國國家經濟委員會主任 Kevin Hassett 週二則說,處理 AI 疑慮的「正確地方」是民間企業。
常見問題
馬斯克提出的 AI 同行評審是什麼
馬斯克主張 xAI、OpenAI、Anthropic、Google、Meta 與三、四家中國公司,在新模型發布前開放 API,讓對手用自家測試檢查模型會不會協助製造生物武器、核彈或刻意欺騙使用者。
AI 公司互相測試模型有前例嗎
有。OpenAI 與 Anthropic 在 2025 年 8 月互相開放 API,用各自的安全測試評估對方已公開的模型並同步公布結果。不過目前沒有對手同意馬斯克提的發布前互測。
📍相關報導📍
「您說得對 總統先生」:黃仁勳在千人演講前與川普電話,同意 AI 放慢論是騙局

