輝達執行長黃仁勳在 CNBC 訪談中拒絕把模型蒸餾稱為盜竊,主張這是競爭;與美國財政部長貝森特和 CISA 把它定性為竊取觀點相反。
(前情提要:白宮 OSTP 點名中國:工業規模 AI 蒸餾攻擊違反安全協議,四步反制裁將啟動)
(背景補充:偷接 Claude 被抓包?中國網信辦調查 DeepSeek、Moonshot,Anthropic 控敏感資料外洩)
輝達執行長黃仁勳近日接受 CNBC《Squawk Box》訪問,被主持人問到模型蒸餾是不是搶劫時?他的答案只有一句:「That’s called competition」,也就是「這叫競爭」。
7 月時,美國財政部長貝森特才把蒸餾稱為「盜竊」並威脅制裁;9 月,CISA、NSA 與 FBI 點名 6 家中國 AI 公司,Anthropic 則公布了具體數字。
一場 2 億次的指控
什麼是模型蒸餾?簡單來說就是讓小模型向大模型學習,拿大模型的回答當教材,成本遠低於從頭訓練。其實 AI 公司也常蒸餾自家模型,所以技術本身並無原罪。
爭議在於「向誰學」。Anthropic 在 9 月的威脅情報報告裡,把非法蒸餾定義為「未經授權,以工業規模、隱蔽地提取模型能力,並複製到另一個模型」,並指出這通常靠詐欺帳號才做得到。
報告觀察到 5 起行動,合計近 2 億次對話交換;其中阿里巴巴的行動是規模最大的一次,2026 年 5 月至 7 月累積超過 1.51 億次交換,分散在 3,500 多個被標記為詐騙的帳號,用於訓練 Qwen 系列模型。
月之暗面則在 10 天內動用 5,380 個假帳號,把近 30 萬筆 Kimi 用戶的請求轉送給 Claude,再把回答當成 Kimi 的回答顯示法。
美國官方的口徑更重。CISA 聯合公告(編號 AA26-251A)稱,中國 AI 公司正在進行「積極、惡意且有針對性的」蒸餾,規模達工業級,目標是 Anthropic、OpenAI、Google 與 xAI 的模型。
貝森特 7 月接受 Fox Business 訪問時說:「本政府贊成開源模型,但我們不贊成智慧財產竊取。」若海外模型偷取美國公司的成果,「我們有能力制裁」。
拆晶片與拆模型不一樣
黃仁勳的論述有一個不同的切角:「人們每天都在蒸餾我的產品,把它拆到只剩原始零件,什麼都測試,這叫競爭。」硬體逆向拆解在產業界相當常見,聽起來確實合理。
但兩者的差別在取得方式。拆晶片,拆的是買回來的東西;蒸餾則是透過 API 取得輸出,而多數模型公司的使用條款,明文禁止拿輸出去訓練競爭模型。
更值得注意的是他給的解方:「如果你不喜歡別人用你的產品,只要認識你的客戶,然後停掉服務。」這句話看似務實,本質上卻把問題從國安與制裁,拉回商業條款的執行層面:這是公司的事。
但真正的問題是,「停掉服務」說起來容易。CISA 與 Anthropic 描述的對手,正是用大量假帳號、第三方 API 聚合商與被稱為「中轉站」的灰色代理,把來源藏起來、繞過地區限制。
Anthropic 抓到阿里巴巴的行動時,已經累積 1.51 億次交換。連客戶是誰都認不出來,更談不上認識。
📍相關報導📍
Anthropic 指控阿里發動「史上最大克隆攻擊」,狂刷 Claude 2,880 萬次
Anthropic 怒控 DeepSeek 等中國 AI 偷學 Claude,拿 2.4 萬假帳號狂刷 1,600 萬問答
Anthropic 在 Claude Fable 5 加入蒸餾偵測功能,能擋住中國開源模型?

