知名人工智慧新創 Anthropic 於今(24)日正式發布全新模型 Claude Opus 5。該模型主打「頂級智力、平民價格」,不僅在程式設計與科研評估上創下新紀錄,其成本更只有前沿模型 Fable 5 的一半。Opus 5 即日起將成為 Claude Max 的新預設模型,為大眾帶來更高效的日常 AI 體驗。
(前情提要:Anthropic 不再顯示 Claude 思考過程摘要,防止 Fable 5 被蒸餾)
(背景補充:Anthropic 衝刺 IPO!傳強制員工簽「10b5-1 自動賣股」計畫,防 9,650 億美元估值拋售潮)
在人工智慧(AI)模型迭代速度日益狂飆的當下,Anthropic 再度投下震撼彈。台北時間 7 月 24 日,Anthropic 官方宣布正式推出全新模型 Claude Opus 5。這款被定位為「深思熟慮且主動」的新生代模型,在整體智力表現上已逼近該公司最頂尖的前沿模型 Claude Fable 5,但其使用價格卻硬生生砍半,展現出極高的成本效益。
程式與代理能力突破,低成本創最高效能
Opus 5 在多項基準測試中達到了新的業界標準(state-of-the-art)。在軟體工程任務方面,它不僅在 Frontier-Bench 測試中超越所有競爭對手,其每任務成本更大幅降低,將前代 Opus 4.8 的表現提升了超過一倍。在知識工作如 Zapier AutomationBench 的商業任務中,同等成本下的通過率是次佳模型的 1.5 倍。
此外,Opus 5 展現了強大的「代理能力(Agentic capabilities)」,能夠自主迭代與驗證工作。例如,在未直接查看圖紙的情況下,它能憑藉程式碼建構出完整的 3D 幾何模型,或在單次對話中獨立為真實系統除錯並建立驗證框架,這些都是早期測試中競爭對手難以達成的成就。
最具對齊性,彈性放寬網路安全尋洞限制
在安全性與對齊(Alignment)方面,Opus 5 寫下了近期模型的最佳紀錄。根據自動化行為審計,其整體未對齊行為分數僅 2.3,不僅比前代 Opus 4.8 甚至 Fable 5 更遵守憲法,欺騙率也降至最低。
針對備受關注的網路安全(Cybersecurity)領域,Anthropic 選擇稍微放寬分類器限制,允許 Opus 5 協助在原始碼中「尋找漏洞」,預期分類器介入頻率比 Fable 5 少約 85%。不過,為防止技術遭惡意利用,官方依然嚴格封鎖漏洞掃描或漏洞利用(exploit)的生成。
全新 Fast 模式上線,API 支援自動降級
為了讓企業與開發者更靈活地部署,Opus 5 即日起已成為 Claude Max 的新預設模型,同時也是 Claude Pro 方案中最強大的選擇。官方更同步推出了「Fast mode(快速模式)」,能以預設速度的 2.5 倍運行,價格則為基礎價格的兩倍。
在開發者體驗上,Claude Platform 新增了支援對話中途變更工具的功能,且不會使 prompt cache 失效。同時,API 也引進了「自動回退(auto-fallback)」機制,當請求被安全分類器標記時,系統會自動路由至其他模型(如 Opus 4.8),以確保服務流暢不中斷。

📍相關報導📍
Anthropic 年營收破 740 億美元遠超 OpenAI!後者兩個月狂增近 3 成急追
