DeepSeek 宣布新模型 V4.1 Flash 預計 9 月 10 日前後上線,官方自評效能、成本、速度全面超越 V4 Pro,過渡期間 Pro 請求將改按 Flash 價格計費,用戶帳單可望變薄。
(前情提要:DeepSeek-V4-Pro 正式版上線!Agent 能力大躍進,原生支援 OpenAI 格式與新定價)
(背景補充:中國八週連發 5 款 AI 模型,更便宜 token 把美國中段班逼上絕路)
帳單會更便宜,這是 DeepSeek 這次公告最直接的訊號。官方預計在 2026 年 9 月 10 日前後正式上線新模型 V4.1 Flash,上線之後、V4.1 Pro 真正推出之前,所有原本打給 Pro 模型的請求,會被系統轉去 V4.1 Flash 處理,並按照 Flash 的價格計費。
換算下來,光是輸出這一項,離峰時段的費用就從每百萬 token 1.98 美元,降到 0.66 美元,等於少掉三分之二。
新模型上線了,官方說它好在哪
DeepSeek 這次要上線的 V4.1 Flash,在 V4.1 系列裡扮演的是速度更快、收費更低的角色,並在過渡期內直接接手原本由 Pro 承接的那一批請求。
官方在公告裡給出的說法是,內部與外部經過大量測試比對之後,V4.1 Flash 在效能、成本、速度,以及把任務做完所花的時間這幾項關鍵指標上,已經全面超越現行的 V4 Pro。不過這要先講清楚一件事:這是 DeepSeek 官方自己講出來的自評結果,目前沒有看到第三方跑分佐證。
官方列出來的優點如下:
- 效能不打折:官方自評指出,V4.1 Flash 在多項任務指標上追平甚至超車 V4 Pro,代表過去只有 Pro 等級才接得住的工作,現在便宜版本理論上也扛得住,前提是官方數字經得起驗證。
- 回應更快:官方表示 V4.1 Flash 把任務完成所需的時間一併縮短,對開發者來說,這代表同一支程式打出去的請求,等結果回來的時間有機會比過去更短。
- 成本結構整套換掉:因為計費比照 Flash,同樣的工作量,帳單金額會跟著計費規則一起往下掉。
- 反饋管道還開著:官方邀請開發者在對比測試期間持續回報使用狀況。
價格變化
V4 Pro 原本每百萬 token 的輸出費用,離峰是 1.98 美元,高峰要 3.96 美元;換成 V4 Flash 的規則之後,離峰只剩 0.66 美元,高峰 1.32 美元,離峰時段等於直接砍掉三分之二。
輸入端的差距更明顯,快取沒命中的情況下,Pro 原本要價 0.66 美元,Flash 僅 0.22 美元;就連快取命中這種最便宜的情境,Pro 是 0.022 美元,Flash 壓到 0.007 美元。完整費率表,官方定價頁上都查得到。Pro 與 Flash 原本大約三倍的價差,這次等於一夜之間被抹平大半,而 8 月 13 日 V4 Pro 版 API 才剛正式對外上線,一個月不到就要把同一批客群導去 Flash,這個轉身速度不算慢。
高峰跟離峰的價差固定是兩倍,高峰時段卡在平日的兩個區間,換算成北京時間,就是上午九點到十二點、下午兩點到六點,剛好貼著亞洲多數團隊的上班時段。也就是說,只有把工作排到晚上或週末執行,才吃得到完整的離峰折扣,這對排程本來就有彈性的團隊比較划算。
📍相關報導📍
GPT-5.6 Luna 價格大砍八成、Terra 降 20% 對標 Gemini,AI 價格戰白熱化

