OpenAI 推出 Ultrafast 模式,靠 Cerebras 晶圓級晶片驅動,GPT-5.6 Sol 每秒輸出 750 個 token,比標準模式快 14 倍,目前僅限量預覽開放。
(前情提要:OpenAI 旗艦模型 GPT-5.6 Sol 獨家登陸 Cerebras,「白毛股神」Serenity 喊「技術獲驗證」進場抄底)
(背景補充:OpenAI 已遞交 IPO 申請!繼 Anthropic、SpaceX 後叩關華爾街)
過去要獲得即時等級的速度,通常意味著必須選擇更小或更專門的模型;不過 OpenAI 13 日在官方部落格中宣布推出新模式 Ultrafast,聲稱要終結這個取捨。
這個模式讓旗艦模型 GPT-5.6 Sol 每秒最多吐出 750 個 token,比標準模式快 14 倍,目前仍是 preview 預覽版,僅開放給一小群客戶。驅動這一切的,不是 OpenAI 自家算力,而是一家晶片商,Cerebras。
背後的邏輯是:與其把模型做小、做專,不如把晶片做大。
一整片晶圓做成一顆晶片
Cerebras 的核心武器是 Wafer-Scale Engine(晶圓級引擎)。簡單來說就是,一般晶片是從一片矽晶圓上切割出成千上百顆小晶片,Cerebras 反其道而行,讓整片晶圓本身就是一顆晶片。這顆巨無霸晶片每片配備 44 GB SRAM,GPT-5.6 Sol 的模型權重可以直接留在晶片上,不用來回搬到記憶體,運算瓶頸也因此被消除。
OpenAI 產品負責人 Rohan Varma 表示:「有了 GPT-5.6 Sol Ultrafast,Cerebras 讓 AI 能跟上你思考、寫程式、協作的速度。」OpenAI 建議這套模式用在事件應變、客服支援、金融市場分析、電商等企業工作流程,也就是那些「慢一秒就少賺一筆」的場景。
官方數字:贏 Claude 11 倍
根據 Cerebras 官方部落格公布的數字,GPT-5.6 Sol Ultrafast 比 Anthropic 的旗艦模型 Claude Fable 5 快 11 倍,比 Opus 4.8 的 Fast mode 快 5 倍;在 GDP-Val 基準測試中,端到端加速達 5.6 倍,且宣稱沒有品質損失。
差距最明顯的是 Humanity’s Last Exam 這套 2,500 題的測試:GPT-5.6 Sol Ultrafast 跑完全部題目花了 11 小時 11 分,Cerebras 稱 Claude Fable 5 跑同樣的任務要 78 小時 27 分,相差近 7 倍。
Previewing Ultrafast mode for @OpenAI's GPT 5.6 Sol, powered by Cerebras.
GPT-5.6 Sol Ultrafast generates responses at up to 750 tokens per second. That's the full, GPT-5.6-Sol model — up to 14× faster than the same model on Standard processing.
It speedran Humanity’s Last… pic.twitter.com/jkwbl6Tl4z
— Cerebras (@cerebras) August 13, 2026
不過要說清楚,以上比較全是 Cerebras 與 OpenAI 的官方自評資料,不是中立第三方跑出來的結果。Anthropic 也有自己的加速版本,Claude 的 fast mode,只是這次在數字上輸給了 OpenAI 這一輪。
快,是要付出代價的
Ultrafast 目前只開放一小群客戶,OpenAI 表示會隨「產能增長」逐步擴大,這句話換個角度看,其實就是產能還不夠。Cerebras 的晶圓級晶片良率與量產速度,向來是這類架構最大的變數,速度紀錄再漂亮,也得先能大規模出貨。
OpenAI 這次沒有比更聰明,而是比誰先把「等待」這件事從產品體驗裡拿掉。只是這份速度,目前是用一整片晶圓、一家供應商、一份自家資料換來的,夠不夠快是一回事,能不能一直快下去,又是另一回事。
📍相關報導📍
「NVIDIA挑戰者」Cerebras在14日掛牌上市!IPO超額20倍上修定價

