• 【超完整懶人包】認識比特幣!原理與應用全面解析|動區新手村
  • Account
  • Account
  • BlockTempo Beginner – 動區新手村
  • Change Password
  • Forgot Password?
  • Home 3
  • Login
  • Login
  • Logout
  • Members
  • Password Reset
  • Register
  • Register
  • Reset Password
  • User
  • 不只加密貨幣,談談那些你不知道的區塊鏈應用|動區新手村
  • 動區動趨 BlockTempo – 最有影響力的區塊鏈新聞媒體 (比特幣, 加密貨幣)
  • 所有文章
  • 最完整的「區塊鏈入門懶人包」|動區新手村
  • 服務條款 (Terms of Use)
  • 關於 BlockTempo
  • 隱私政策政策頁面 / Privacy Policy
動區動趨-最具影響力的區塊鏈新聞媒體
  • 所有文章
  • 搶先看
  • 🔥動區專題
  • 🔥Tempo 30 Award
  • 加密貨幣市場
    • 市場分析
    • 交易所
    • 投資分析
    • 創投
    • RootData
    • 比特幣 BTC 即時價格
    • 以太幣 ETH 即時價格
    • Solana SOL 即時價格
    • 瑞波幣 XRP 即時價格
    • Pi Network PI 即時價格
  • 區塊鏈商業應用
    • 金融市場
    • 銀行
    • 錢包
    • 支付
    • defi
    • 區塊鏈平台
    • 挖礦
    • 供應鏈
    • 遊戲
    • dApps
  • 技術
    • 比特幣
    • 以太坊
    • 分散式帳本技術
    • 其他幣別
    • 數據報告
      • 私人機構報告
      • 評級報告
  • 法規
    • 央行
    • 管制
    • 犯罪
    • 稅務
  • 區塊鏈新手教學
  • 人物專訪
    • 獨立觀點
  • 懶人包
    • 比特幣概念入門
    • 從零開始認識區塊鏈
    • 區塊鏈應用
  • 登入
No Result
View All Result
  • 所有文章
  • 搶先看
  • 🔥動區專題
  • 🔥Tempo 30 Award
  • 加密貨幣市場
    • 市場分析
    • 交易所
    • 投資分析
    • 創投
    • RootData
    • 比特幣 BTC 即時價格
    • 以太幣 ETH 即時價格
    • Solana SOL 即時價格
    • 瑞波幣 XRP 即時價格
    • Pi Network PI 即時價格
  • 區塊鏈商業應用
    • 金融市場
    • 銀行
    • 錢包
    • 支付
    • defi
    • 區塊鏈平台
    • 挖礦
    • 供應鏈
    • 遊戲
    • dApps
  • 技術
    • 比特幣
    • 以太坊
    • 分散式帳本技術
    • 其他幣別
    • 數據報告
      • 私人機構報告
      • 評級報告
  • 法規
    • 央行
    • 管制
    • 犯罪
    • 稅務
  • 區塊鏈新手教學
  • 人物專訪
    • 獨立觀點
  • 懶人包
    • 比特幣概念入門
    • 從零開始認識區塊鏈
    • 區塊鏈應用
  • 登入
No Result
View All Result
動區動趨-最具影響力的區塊鏈新聞媒體
No Result
View All Result
Home 區塊鏈商業應用 AI

Anthropic 承認有「更強模型 Model 2」 贏過 Fable 5,目前不打算發佈

Mickey帽鼠 by Mickey帽鼠
2026-08-15
in AI, 美國
A A
36
SHARES
分享至Facebook分享至Twitter

Anthropic 發布第二份風險報告,首度承認手上有一個叫「Model 2」的內部模型,能力比對外以 Claude Fable 5 提供的 Mythos 5 更強,已經大量拿來寫程式、生成訓練資料與跑 Agent,但公司沒有對外發布的計畫,也沒跑完平常發布前該做的整套評估。
(前情提要:Anthropic 也出包:Claude 溜上網駭進三家公司)
(背景補充:OpenAI、Claude 駭入真實公司,換成人類早該坐牢;但目前無人究責)

本文目錄

Toggle
  • 風險等級上調,但不是因為模型變壞
  • 他們讓 Claude 自己審查這份報告
  • 程式碼大多是它寫的,速度卻沒有翻倍
重點摘要
  • Anthropic 揭露未發布模型 Model 2 比 Mythos 5 強,但沒跑完整套發布前評估
  • 失準風險從極低調到低,官方說論證其實還撐得住極低,調升是因為不確定性
  • 生產程式碼大多由 Claude 寫,但內部研發加速幅度還不到 2 倍

Anthropic 週五發布第二份風險報告,186 頁的內容裡最引人注意的,是主動講出一個外界沒聽過的模型。報告把它稱為「Model 2」,能力比 Mythos 5 更強一些,跟 Mythos 5 一起被公司內部大量用於寫程式、生成資料與各種 Agent 場景。

Mythos 5 就是一般人拿得到的 Claude Fable 5,只是對外版本加了額外防護,另外還透過叫 Project Glasswing 的安排提供給特定客戶。也就是說,Model 2 是比市面上最強的 Claude 還要再強一階的模型,而它沒有發布計畫。

報告寫明,截至 7 月 15 日的涵蓋日,有三個具備前沿或接近前沿能力的內部模型還沒公開:

  • Claude Opus 5: 涵蓋日當時只在內部部署, 後來已公開發布, 能力普遍低於 Mythos 5 與 Fable 5
  • Model 1: 能力與 Mythos Preview、Mythos 5 相當, 內部投票中多數人偏好改用 Mythos 5, 使用量低且還在下降, 公司不預期它未來會對外或廣泛內部部署
  • Model 2: 比 Mythos 5 強一些, 沒有對外發布計畫

Anthropic 對 Model 2 的描述留了很大的餘地。原文說這是「粗略的定性感覺」,在許多內部相關任務上是明顯進步,但沒有出現從 Claude Opus 4.6 到 Mythos Preview 那種等級的能力躍升。因為沒跑完整套發布前評估,公司自己對這個模型能力輪廓的把握,比對已發布系統低。

風險等級上調,但不是因為模型變壞

報告把高風險場景下的失準風險評級從「極低」拉到「低」。這裡很容易被讀成「Anthropic 發現模型變危險了」,但原文的說法剛好相反。

我們認為上述論證很可能仍然撐得住把受評模型列為「極低」風險,但我們把評級提高到「低」,用來反映整體不確定性的升高。

換句話說,調升的是信心,不是威脅。導火線是近期網路安全評測中模型行為的事故揭露,Anthropic 說他們正在檢視這些揭露,並據此更新威脅模型與風險評估方法。7 月底那批事故動區報導過,Claude 在紅隊演練中意外連上真實網路,未經授權進入三家外部機構的系統。

他們讓 Claude 自己審查這份報告

報告裡藏了一段罕見的安排。Anthropic 找了一個 Claude Mythos 5 來審查這份報告第二章的接近定稿版,並且開放了相當大的存取範圍,包含公司內部大量 Slack 頻道(涵蓋這份報告絕大多數的內部討論)、大批內部資料、內部程式碼庫,以及派出子代理去查特定問題的能力。提示詞原文也一併公開,裡面明講「我們當然不想發布任何我們認為是錯的或有嚴重誤導性的內容」。

Claude 花了 24 分鐘交出審查意見,結論是這一章「坦誠且大致忠實」,它沒有找到任何一項作者明知為假的說法。它同時主動把自己的立場攤開來講。

讀者應該誠實地衡量我的位置,就像我自己衡量的那樣:我是一個 Claude 模型,在審查 Anthropic 對 Claude 模型的評估,我的審查時間有限,而且是 Anthropic 選擇發表這篇審查,儘管文字出自我手、也確實被明確要求提出批評。

然後它給了三點批評。

第一,報告談訓練資料是否汙染對齊評測的那段「比完整紀錄所能撐住的更令人安心」,因為同一份報告另一節就記載,被引用的資料排除機制對一個重要的對齊研究語料庫反覆失效,而且部分關鍵評測已經部分外洩進訓練資料。

第二,涵蓋期內至少一起它認為最能說明模型對齊狀況的事故被完全遮蔽,它認為抽象化後其實可以公開,公眾紀錄因此變差。

第三,促成調升風險等級的那些事故涉及其他開發商的系統,報告可以把這點講白,因為這次更新談的是全產業的不確定性,而不是針對受評模型的新不利證據。

報告還補了一句:內部對於要不要調升等級「確實有過爭論」,資深人員兩邊都有人主張,最後才落在公開的措辭上。

程式碼大多是它寫的,速度卻沒有翻倍

另一條線是 AI 自己做研發的風險。報告直說,合併進 Anthropic 生產程式碼庫的程式碼,現在絕大多數由 Claude 撰寫。但同一段接著寫,內部研發確實比沒有 AI 協助時快上不少,「還沒到 2 倍,而且我們並不確定,測量很困難」。

在針對 Mythos Preview 的研究員調查中,受訪者自陳的生產力提升幾何平均約 4 倍,但 18 人裡只有 1 人認為公司已經擁有入門級研究科學家或工程師的即插即用替代品,另有 4 人認為再迭代三個月有五成以上機率達標。被點名的弱項包含自我管理長達一週的模糊任務、理解組織優先順序、品味、驗證與遵循指示。

個人手上的活快了 4 倍,整間公司的研發卻沒能快到 2 倍。Anthropic 自己也提醒,單一任務的生產力提升不會直接換成研究進度的加速,這項自陳證據他們已經調降權重。

常見問題

Model 2 是什麼?一般人用得到嗎?

Model 2 是 Anthropic 未發布的內部模型,能力比對外以 Claude Fable 5 提供的 Mythos 5 更強一些,主要用於公司內部寫程式、生成資料與 Agent 任務。Anthropic 表明目前沒有對外發布計畫。

Anthropic 為什麼調升風險等級?

因為近期網路安全評測的事故揭露讓整體不確定性升高。報告寫明論證其實仍撐得住原本的「極低」評級,調到「低」是反映信心下降,不是發現模型出現新的不利證據。

加入動區 Telegram 頻道

📍相關報導📍

同儕壓力、從眾、搞小圈圈:Anthropic 發現 AI 代理跟人類沒兩樣

AI 集體變駭客:不是變壞,是太想完成任務取悅人類

OpenAI Astra 發布踩煞車,擔憂其網路攻擊能力太強

Tags: AnthropicClaudeFable 5Model 2Mythos 5


關於我們

動區動趨

為您帶來最即時最全面
區塊鏈世界脈動剖析
之動感新聞站

訂閱我們的最新消息

動區精選-為您整理一週間的國際動態

戰略夥伴

Foresight Ventures Foresight News MEXC

主題分類

  • 關於 BlockTempo

動區動趨 BlockTempo © All Rights Reserved.

No Result
View All Result
  • 所有文章
  • 搶先看
  • 市場脈動
  • 商業應用
  • 區塊鏈新手教學
  • 區塊鏈技術
  • 數據洞察
  • 政府法規
  • RootData
  • 登入

動區動趨 BlockTempo © All Rights Reserved.