Anthropic 推出 Claude Haiku 5.5,四項 API 牌價與 OpenAI GPT-6 Luna 完全相同,短請求比前代便宜 90%。
(前情提要:OpenAI 推出 GPT-6 Sol 與 Luna!價格大砍 50%,頂級 AI 能力全面下放)
(背景補充:Sonnet 5.5 上線媲美 Opus:Anthropic 說省 3 成、第三方說貴一半,關鍵在推理強度)
Anthropic 在美國時間 10 月 7 日正式推出 Haiku 5.5,同步在 Claude Platform、Amazon Web Services、Google Cloud 與 Microsoft Azure 上線。四個價格欄位,Claude Haiku 5.5 與 OpenAI 的 GPT-6 Luna 一模一樣:每百萬 token 輸入 0.10 美元、輸出 0.50 美元、快取讀取 0.01 美元、快取寫入 0.125 美元。
對照之下,Google 的 Gemini 3.5 Flash-Lite 標準價仍是輸入 0.30 美元、輸出 2.50 美元,輸出價是這兩家的 5 倍。但牌價一樣,不代表帳單一樣。
九成折扣的算術
降價 90%,是這次最搶眼的數字。但它有條件。Anthropic 的定價頁載明,價格依提示詞長度分成兩檔:10 萬 token 以內,輸入與輸出都是 Haiku 4.5 的十分之一;超過 10 萬 token,費率變成輸入 0.50 美元、輸出 2.50 美元,僅降 50%。低檔與高檔,整整差 5 倍。
官方表示,Haiku 4.5 約 90% 的請求落在 10 萬 token 以內,所以多數請求吃得到九成折扣。
但還有第二個扣項:Haiku 5.5 換了新版 tokenizer,也就是把文字切成 token 的規則。Anthropic 的更新說明寫明,同一段文字在新版會被算成比 Haiku 4.5 多約 30% 的 token。單價降了,計費的數量變多,再加上一成的長請求僅降一半,Anthropic 在公告正文給的數字是平均約降 75%。
effort 成本不同
另外還有個落差是 effort,也就是推理強度:檔位越高,模型想得越久,花得也越多。共有 Low、Medium、High、Xhigh、Max 五檔,API 預設是 Medium。而公告主表裡 Haiku 5.5 的跑分,全是開到 Max 的成績。這些數字是 Anthropic 自行發表,並非第三方驗證。

換成預設的 Medium,操作電腦的 OSWorld 從 72.4% 會掉到 53.3%,知識工作的 GDPval-AA 從 1620 掉到 1277,代理式寫程式的 Terminal-Bench 從 39.2% 掉到 20.3%。
寫程式又是另一回事。Terminal-Bench 上,Haiku 5.5 Max 拿 39.2%,成本卻比 Sonnet 5.5 High 的 43% 還高約八成。Anthropic 在公告裡也直說,複雜的代理式寫程式仍該交給 Sonnet 5.5 與 Opus 5.5。
子代理才是正職
所以 Haiku 5.5 的位置很清楚:不是取代大模型,而是替大模型跑腿。
這種分工叫子代理(subagent):由大模型當主管拆解任務,把瑣碎、範圍明確的小工作外包給小模型。Anthropic 列出的適用場景,是摘要、壓縮上下文、查資料庫、分類這類高量又在意成本的工作。速度方面,官方稱它是標準速度下最快的模型,但註腳承認比 Opus 的 Fast Mode 慢,公告也沒有給每秒輸出多少 token 的數字。
金融 AI 公司 Rogo 給了一個例子:大模型負責做簡報,Haiku 5.5 子代理則鑽進 10-K 年報,把投影片需要的分部營收那一行抓回來。Rogo 的 Alex Wang 說:「它準確到我們願意放心交給它,又快又便宜到可以大量跑。」AlphaSense 的 Ask in Document 功能每週約 800 萬次呼叫,在 400 筆查詢測試中,Haiku 5.5 得 0.84,Haiku 4.5 得 0.76。兩則都出自 Anthropic 公告裡的客戶引述。
📍相關報導📍
Anthropic 突襲發布 Claude Opus 5.5!效能逼近 Fable,API 降價 40% 還自帶「用量重置」
實測 Claude $200 訂閱:全跑 Opus 5.5 額度等值 1.17 萬美元 API 費(差58倍)
Anthropic 擴大新創補貼計劃:Claude Team 免費一年,沒拿創投也能申請

