Gemini 3.5 Pro 定檔 7 月 17 日釋出,谷歌推倒舊基座從零重訓

寧願延期也要重寫底座

2026-07-17 16:40
Gemini
Gemini

谷歌給 Gemini 3.5 Pro 定下了 7 月 17 日的釋出視窗。更值得玩味的是原因:原本的基座模型被整個推翻,從頭重建。早期測試暴露出三個它怎麼調都補不齊的短板——數學推理、複雜 SVG 場景生成,以及整體畫質,谷歌寧可延期也不願發殘次品,把口碑擺在了速度前面,這在谷歌歷史上並不多見。

這步棋走得不太常規。Gemini 3.5 Pro 原本是 2.5 Pro 的演進版,跳票已久,6 月沒能在視窗期上線,整個 7 月都卡在有限的企業預覽裡。谷歌內部的說法是,不願發一個在和 Fable 5、GPT-5.6 正面對比時會掉鏈子的模型——尤其在過去半年研究團隊走了不少人之後,這口氣更得爭回來,否則在旗艦模型競爭中會進一步掉隊,人才也會繼續外流。

新版本對外流傳的規格相當亮眼: 200 萬 token 上下文視窗(比 2.5 Pro 的 100 萬直接翻倍)、Deep Think 深度推理模式,以及能串聯複雜程式設計與工具呼叫的自主工作流。定價也站在高階檔:輸入每百萬 token 15 美元、輸出 60 美元,Deep Think 鎖在每月 250 美元的 Ultra 檔,明顯是衝著重度企業使用者去的,靠長上下文和推理質量賺錢。

時間點的戲劇性在於「三強交匯」。Gemini 3.5 Pro 在 7 月 17 日落地,DeepSeek V4 要在 7 月 24 日從預覽轉穩定版,GPT-5.6 的 Sol/Terra/Luna 三子模型還卡在政府審查的有限預覽裡。企業評估模型棧的視窗,恰好就在這十天,這十天裡的跑分,會影響未來半年的採購決策,所以誰都不敢先出昏招。

把視角拉到谷歌自身,Gemini 的成敗不止關乎面子。谷歌把模型塞進了搜尋、Workspace、Cloud、安卓,模型一旦掉隊,整個廣告與雲業務的敘事都會受損。重訓底座雖然燒錢又費時,但比起發一個半成品、被對手反覆拿來當反面教材,谷歌顯然算清了這筆賬,寧願慢一點也要把地基打牢。

對企業使用者來說,最該盯的不是「能不能吃下 200 萬 token 的 prompt」,而是推理質量在這麼長上下文裡到底穩不穩。2.5 Flash 在長流程裡暴露過 token 效率問題,Pro 重訓版能不能跨過那道坎,才是真指標。模型大戰打到今天,引數和視窗長度已經不是勝負手,穩定輸出才是。