Google 員工傳出已搶先內測代號 3.8 的下一代 Flash,但旗艦 Gemini 3.5 Pro 卻連續跳票三次,至今沒有型號、定價與上線日。
(前情提要:Google 正式發布 Gemini 3.7 Flash!主打超強寫碼與 AI 代理,年底前祭「半價」流血戰)
(背景補充:Gemini 3.7 Flash 消息外洩:Google 改名 15 秒關 PR,傳 API 價格直接砍半)
剛推出兩週的 Gemini 3.7 Flash,都還沒站穩腳步,Google 內部已經傳出有員工搶先測試代號「Gemini 3.8 Flash Preview」的下一代模型。根據Business Insider 取得的內部截圖顯示,這款代號 3.8 的模型已經出現在 Google 內部的程式開發平台 Jetski 上,一名正在測試的員工形容它「感覺明顯優於 3.7 Flash」,但也坦言現在下定論還太早。
藏不住的內測
Jetski 是 Google 內部用來搶跑新模型的開發平台,性質類似「員工限定的搶先體驗版」,一般用戶完全看不到。
「Gemini 3.8 Flash Preview」目前就只出現在這裡,還沒有對外公開的跡象。使用過的員工評價相當保留:比 3.7 Flash「感覺明顯更好」,但拒絕多說,理由是測試時間還太短,現在下結論太早。
這不是唯一的線索。根據 Reddit 上的討論,一群眼尖的 AI 追蹤者聲稱,已經在 Arena AI(Google 過去用來搶先測試未發表版本的模型評測網站)上看到 Gemini 3.8 Flash 的蹤跡。
三週一迭代
Gemini 3.5 Flash 在今年 5 月的 I/O 大會上發表,當時的輸出定價是每百萬 token 9.00 美元。
7 月 21 日,Google 推出 3.6 Flash,做同一件工作平均少燒 17% 的輸出 token,定價也跟著降到每百萬 token 輸入 1.50 美元、輸出 7.50 美元。
三週後的 8 月 13 日,3.7 Flash 接力上線,初期定價再砍半,輸入 0.75 美元、輸出 3.75 美元,等於 3.6 Flash 標準價的一半,效期一路排到 12 月底。
DeepMind 公布的模型卡寫得很直白,這一輪是替軟體工程與 agent 工作流程調校的演算法改良,不是重新訓練的全新模型,脈絡長度維持在約 105 萬 token。
缺席的旗艦
對比之下,Google 真正的旗艦模型反而動彈不得。Gemini 3.5 Pro 早在 5 月的 I/O 大會就已經預告,直到 8 月下旬都還沒有正式發布,連續錯過 6 月、7 月中、8 月初三個目標時間點,沒有型號、沒有定價,也沒有上線日。
之前我們也報導過,DeepMind 甚至放棄原本的底層架構,從預訓練階段整個重來,原因是多步驟數學推理與生成能力遇到瓶頸,另外還牽涉程式開發可靠度的問題,以及幾位資深研究員的離職。
但同一段時間,對手完全沒有等它。Anthropic 在 6 月 9 日推出 Fable 5,OpenAI 則在 7 月 9 日發表 GPT-5.6 Sol。截至目前,Google 手上其實沒有真正意義上的前沿模型。目前能拿出來應戰的,只剩下一路狂奔的 Flash 系列。
但至少在用戶使用的成績還沒有太差。第二季,Gemini App 的月活躍用戶衝到 9.5 億。執行長 Sundar Pichai 在財報電話會議上提到,模型 API 每分鐘處理 220 億個 token,比上一季的 160 億以上再往上跳一大截,拉動這波成長的,正是「主力 Flash 模型」。
Pichai 同時鬆口,體型更大的 Gemini 4 已經在路上,他形容那會是一個大得多的基礎模型,才撐得起下一個前沿位置的競爭。
📍相關報導📍
Google 發表最強多模態影音模型「Gemini Omni」!支援對話式無縫修片,本週免費登陸 YouTube
Google 推出 Gemini 3.6 Flash 等三款新模型!3.5 Flash-Lite 飆出極速,Gemini 4 預訓練已啟動
Google 上線 Gemini 3.1 Flash TTS:音訊標籤讓 AI 配音更生動、支援 70+ 語言,Google AI Studio 免費體驗

