Gemini 3.5 Pro 定档 7 月 17 日发布,谷歌推倒旧基座从零重训

宁愿延期也要重写底座

2026-07-17 16:40
Gemini
Gemini

谷歌给 Gemini 3.5 Pro 定下了 7 月 17 日的发布窗口。更值得玩味的是原因:原本的基座模型被整个推翻,从头重建。早期测试暴露出三个它怎么调都补不齐的短板——数学推理、复杂 SVG 场景生成,以及整体画质,谷歌宁可延期也不愿发残次品,把口碑摆在了速度前面,这在谷歌历史上并不多见。

这步棋走得不太常规。Gemini 3.5 Pro 原本是 2.5 Pro 的演进版,跳票已久,6 月没能在窗口期上线,整个 7 月都卡在有限的企业预览里。谷歌内部的说法是,不愿发一个在和 Fable 5、GPT-5.6 正面对比时会掉链子的模型——尤其在过去半年研究团队走了不少人之后,这口气更得争回来,否则在旗舰模型竞争中会进一步掉队,人才也会继续外流。

新版本对外流传的规格相当亮眼: 200 万 token 上下文窗口(比 2.5 Pro 的 100 万直接翻倍)、Deep Think 深度推理模式,以及能串联复杂编程与工具调用的自主工作流。定价也站在高端档:输入每百万 token 15 美元、输出 60 美元,Deep Think 锁在每月 250 美元的 Ultra 档,明显是冲着重度企业用户去的,靠长上下文和推理质量赚钱。

时间点的戏剧性在于「三强交汇」。Gemini 3.5 Pro 在 7 月 17 日落地,DeepSeek V4 要在 7 月 24 日从预览转稳定版,GPT-5.6 的 Sol/Terra/Luna 三子模型还卡在政府审查的有限预览里。企业评估模型栈的窗口,恰好就在这十天,这十天里的跑分,会影响未来半年的采购决策,所以谁都不敢先出昏招。

把视角拉到谷歌自身,Gemini 的成败不止关乎面子。谷歌把模型塞进了搜索、Workspace、Cloud、安卓,模型一旦掉队,整个广告与云业务的叙事都会受损。重训底座虽然烧钱又费时,但比起发一个半成品、被对手反复拿来当反面教材,谷歌显然算清了这笔账,宁愿慢一点也要把地基打牢。

对企业用户来说,最该盯的不是「能不能吃下 200 万 token 的 prompt」,而是推理质量在这么长上下文里到底稳不稳。2.5 Flash 在长流程里暴露过 token 效率问题,Pro 重训版能不能跨过那道坎,才是真指标。模型大战打到今天,参数和窗口长度已经不是胜负手,稳定输出才是。