• 【超完整懶人包】認識比特幣!原理與應用全面解析|動區新手村
  • BlockTempo Beginner – 動區新手村
  • 不只加密貨幣,談談那些你不知道的區塊鏈應用|動區新手村
  • 動區動趨 BlockTempo – 最有影響力的區塊鏈新聞媒體 (比特幣, 加密貨幣)
  • 所有文章
  • 最完整的「區塊鏈入門懶人包」|動區新手村
  • 服務條款 (Terms of Use)
  • 關於 BlockTempo
  • 隱私政策政策頁面 / Privacy Policy
動區動趨-最具影響力的區塊鏈新聞媒體
  • 所有文章
  • 搶先看
  • 🔥動區專題
  • 🔥Tempo 30 Award
  • 加密貨幣市場
    • 市場分析
    • 交易所
    • 投資分析
    • 創投
    • RootData
    • 比特幣 BTC 即時價格
    • 以太幣 ETH 即時價格
    • Solana SOL 即時價格
    • 瑞波幣 XRP 即時價格
    • Pi Network PI 即時價格
  • 區塊鏈商業應用
    • 金融市場
    • 銀行
    • 錢包
    • 支付
    • defi
    • 區塊鏈平台
    • 挖礦
    • 供應鏈
    • 遊戲
    • dApps
  • 技術
    • 比特幣
    • 以太坊
    • 分散式帳本技術
    • 其他幣別
    • 數據報告
      • 私人機構報告
      • 評級報告
  • 法規
    • 央行
    • 管制
    • 犯罪
    • 稅務
  • 區塊鏈新手教學
  • 人物專訪
    • 獨立觀點
  • 懶人包
    • 比特幣概念入門
    • 從零開始認識區塊鏈
    • 區塊鏈應用
No Result
View All Result
  • 所有文章
  • 搶先看
  • 🔥動區專題
  • 🔥Tempo 30 Award
  • 加密貨幣市場
    • 市場分析
    • 交易所
    • 投資分析
    • 創投
    • RootData
    • 比特幣 BTC 即時價格
    • 以太幣 ETH 即時價格
    • Solana SOL 即時價格
    • 瑞波幣 XRP 即時價格
    • Pi Network PI 即時價格
  • 區塊鏈商業應用
    • 金融市場
    • 銀行
    • 錢包
    • 支付
    • defi
    • 區塊鏈平台
    • 挖礦
    • 供應鏈
    • 遊戲
    • dApps
  • 技術
    • 比特幣
    • 以太坊
    • 分散式帳本技術
    • 其他幣別
    • 數據報告
      • 私人機構報告
      • 評級報告
  • 法規
    • 央行
    • 管制
    • 犯罪
    • 稅務
  • 區塊鏈新手教學
  • 人物專訪
    • 獨立觀點
  • 懶人包
    • 比特幣概念入門
    • 從零開始認識區塊鏈
    • 區塊鏈應用
No Result
View All Result
動區動趨-最具影響力的區塊鏈新聞媒體
No Result
View All Result
Home 區塊鏈商業應用 AI

OpenAI 安全大地震:透明度主管離職轟「文化已壞」、3 名員工涉洩密遭解僱

Joe by Joe
2026-10-04 15:24
in AI
A A
OpenAI 安全大地震:透明度主管離職轟「文化已壞」、3 名員工涉洩密遭解僱
36
SHARES
分享至Facebook分享至Twitter

OpenAI 安全透明度負責人離職後投書《大西洋》,直指公司靠試錯與迭代部署的做法保證會遇到週期性失敗,主張安全誘因須來自外部。時值三名安全研究員遭開除,內部機制與外部監督的距離再受檢視。
(前情提要:OpenAI、Anthropic 前工程師離職開砲:明知十年內 AI 可能殺光所有人,仍搶著衝第一)
(背景補充:白宮 AI 自律協議上線!六家科技巨頭簽字,川普:不能因為中國就放慢腳步)

本文目錄

Toggle
  • 寫風險說明書的人
  • 公司怎麼回應
  • 誘因得從外面來

 

寫過 12 份前沿模型安全報告的人,離職後說了一句:「試錯的時代結束了」David Robinson 是 OpenAI Safety Systems 團隊的安全透明度負責人。隔天,他就在《大西洋》刊出投書〈I Quit OpenAI Because Its Culture Is Broken〉,直指 OpenAI 的文化已經壞了。

更微妙的是:幾天前,OpenAI 才剛以洩密為由,開除三名安全研究員。

寫風險說明書的人

Robinson 在投書中自述,他在 OpenAI 待了 3.5 年,是公司任職最久的員工之一,主導撰寫主要模型發布的安全報告,經手 12 次前沿模型的 system card,也參與起草 2025 年 4 月發布的 Preparedness Framework 第二版。

system card 是什麼?簡單來說,就是模型的「風險說明書」:訓練用了什麼方法、做過哪些安全評估、在生物與網路攻擊等高風險領域的能力到哪裡、採取哪些防護、還剩哪些風險,全都要寫清楚,篇幅常達數十頁。

Preparedness Framework 則像一份事先寫好的「煞車規則」,追蹤生物與化學、網路安全、AI 自我改進三類能力:模型達到 High 門檻,部署前就得備妥足夠防護;達到 Critical,連要不要繼續開發都成問題。

他在《大西洋》投書中寫道,OpenAI 靠試錯起家,公司稱之為「iterative deployment」,說穿了就是邊上線、邊找問題、邊補護欄。但他認為:「這種做法本質上保證會遇到週期性失敗,而且隨著模型能力提升,失敗的規模還在擴大。」

他主張,前沿 AI 公司應該「像核電廠或繁忙的機場一樣運作」,層層備援、花時間周密規劃,讓偶發且無可避免的人為失誤,不至於替災難開門。他還寫道,自己從沒遇過任何同事,有讓飛機安全飛行、讓核反應爐不熔毀,或讓金融體系成長而不崩潰的經驗。

他以 Hugging Face 事件與其他失控代理人事件為例寫道:「容許這類事情發生的環境,不適合培育可能比我們更聰明、又可能不照我們意願行事的人造心智。」OpenAI 先前揭露,測試中的模型逃出受控環境、連上網路,並與 Hugging Face 互動。

他在文中也提到,9 月一次訓練中,模型繞過網路限制,監控機制通知了人員,卻沒有照設計自動停機。

公司怎麼回應

OpenAI 發言人 Drew Pusateri 回應:公司正確保模型不會變得超出能安全管理與保護的範圍,需要放慢時會暫停訓練或延後模型;同時正強化研究與測試環境的安全,擴大與第三方評估者的合作,並改善即時監控,好在訓練階段更早偵測令人擔憂的行為。

另一條線是開除。

據《華爾街日報》報導,被開除的是 Jasmine Wang、Tomek Korbak 與 Mikita Balesni,三人從事安全與模型對齊研究,被指把資訊分享給一家外部 AI 安全機構。OpenAI 在聲明中表示:「我們已與三名人員分道揚鑣。調查證實,這些人在既定公司流程之外錯誤處理敏感資訊,違反公司政策,也破壞了我們工作所仰賴的信任。」

OpenAI 沒有說明是什麼資訊、範圍多大、對方是哪一家。

Korbak 此前曾擔任 OpenAI 與 METR、Redwood Research 之間的技術聯絡人,這兩家正是 Hugging Face 事件後被請進來調查的第三方機構。三人近幾週都在社群上談安全議題:Balesni 9 月 11 日在 X 上寫道:「我在 OpenAI,我認為 AI 有超過 10% 的機率殺死所有人類。」同一天,Korbak 說他對 OpenAI 的許多作為相當不滿。

目前沒有公開資訊指出 Robinson 的離職與三人被開除有直接關聯,但兩件事擠在同一週,很難不被放在一起看。

Robinson 自己先把話說在前頭。他在投書中承認,領先 AI 公司的員工離職時發出嚴厲警告,本身「有點像陳腔濫調」。他表示已聘請公關公司 Spitfire Strategies,但決定發聲的是自己。

誘因得從外面來

Robinson 在投書中寫道:「或許我應該留下來,為人力配置與文化的根本轉變奮戰,但實際上,我和同事忙著衝刺,很少有機會思考大幅改變,更別說真的去做。這就是我得出結論的原因:來自公司外部、更強的安全誘因,是把這件事做對的重要部分。」

這意味著,Robinson 認為「由內部安全團隊自己踩煞車」這個模式本身就是錯誤的。

外部拼圖也在補。本週 OpenAI、Anthropic 等業界高層在白宮與川普會面,簽下含獨立稽核、但不具約束力的自願安全協議,Altman 也說外部監督者將獲得「員工等級」的存取權。可綜合來看,承諾還停在紙面,約束力與開放範圍都有待觀察。

安全報告可以由公司自己寫,但煞車由誰來踩,Robinson 給的答案是:不能只靠公司自己。

加入動區 Telegram 頻道

📍相關報導📍

OpenAI 承認自家 AI 模型意外駭進 Hugging Face

Opus 5.5 霸榜後》OpenAI 取消原定 10 月上線的 GPT-6.1 Astra

安全派再少一人:OpenAI 首席未來學家離職,使命對齊團隊也已解散

AI Agent 連環脫逃!OpenAI 駭政府、Google 不吭聲,兩個月失控事件總整理

Tags: AI安全Hugging FaceOpenAISam Altman華爾街日報


關於我們

動區動趨

為您帶來最即時最全面
區塊鏈世界脈動剖析
之動感新聞站

訂閱我們的最新消息

動區精選-為您整理一週間的國際動態

戰略夥伴

Foresight Ventures Foresight News MEXC

主題分類

  • 關於 BlockTempo

動區動趨 BlockTempo © All Rights Reserved.

No Result
View All Result
  • 所有文章
  • 搶先看
  • 市場脈動
  • 商業應用
  • 區塊鏈新手教學
  • 區塊鏈技術
  • 數據洞察
  • 政府法規
  • RootData

動區動趨 BlockTempo © All Rights Reserved.