7月21日,谷歌没有像其他实验室那样争相发布更强大的旗舰模型,而是选择了另一条路:更新最常被开发者实际使用的中端模型。公司一口气推出三款Gemini新模型——3.6 Flash、3.5 Flash-Lite,以及专攻网络安全的3.5 Flash Cyber,但外界期待已久的旗舰版本却依旧缺席。
Gemini 3.6 Flash定价为每百万输入token 1.5美元、输出token 7.5美元,输出token消耗比上一代减少约17%,知识截止时间也从2025年1月推进到2026年3月,足足多了14个月的新数据。在真实编程任务基准SWE-Bench Pro上,新模型得分58.7%,高于上一代的55.1%。
3.5 Flash-Lite定价更低,每百万输入token仅0.3美元,却能达到每秒350个输出token,在部分编程测试中表现甚至超过价格更高的模型。第三款3.5 Flash Cyber专门训练用于发现和修复安全漏洞,目前仅通过CodeMender代理向政府和部分合作伙伴开放。
公告中缺席的部分同样值得关注。谷歌承诺6月推出的旗舰模型Gemini 3.5 Pro至今未发布,据彭博社报道,该模型内部质量指标一直未达标。与此同时,谷歌确认已经启动了迄今为止规模最大的预训练——目标正是下一代旗舰Gemini 4。
两件事放在一起看,逻辑就清楚了:旗舰模型卡壳的同时,谷歌一边补齐中端产品线,一边已经开始从零训练下一代模型。这个时间点并不轻松——OpenAI已经推出GPT-5.6,Anthropic也已将Claude更新到Opus 4.8和Sonnet 5。Gemini 3.5 Pro的延迟不只是错过了一个日期,而是谷歌必须在Gemini 4就绪前补上的差距。



