谷歌连发三款Gemini新模型,唯独不给3.5 Pro:战略拖延还是技术卡壳?
三箭齐发,但都绕开了”旗舰”
7月21日,Google DeepMind一口气发布了三款新模型:Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber。表面上看是一场密集的产品更新,但当你仔细看就会发现:被社区期待已久的旗舰模型Gemini 3.5 Pro依旧缺席。

Gemini 3.6 Flash被定位为”主力模型”,在编程、知识工作和多模态能力上均有提升,同时Token消耗降低了17%,在效率和成本上碾压前代3.5 Flash。3.5 Flash-Lite则主打极致性价比,适用于对成本敏感的大规模Agent部署场景。而3.5 Flash Cyber则是一个特别版——专注于网络安全漏洞发现与修复,仅面向政府和可信合作伙伴开放。
Pro去哪了?时间线暴露了焦虑
Gemini 3.5 Pro上一次更新还是在今年2月。在这漫长的5个月里,对手们可没闲着:OpenAI发布了GPT-5.5并开始推送GPT-5.6,Anthropic相继推出Claude Opus 4.8、Claude Sonnet 5,甚至向公众开放了前沿模型Fable 5的访问权限。
5月份谷歌推出3.5 Flash时曾信心满满地预告Pro版本”已在内部使用,下月将推出”。然而7月16日,彭博社援引知情人士报道称,Gemini 3.5 Pro因未能达到内部性能目标而面临延迟。一个大型AI实验室在最关键的旗舰产品上连续跳票,这在当前的竞争节奏中几乎不可接受。
Google DeepMind产品负责人Logan Kilpatrick在社交平台表示,3.5 Pro正在与合作伙伴测试中,希望”很快落地”;同时透露团队已经启动了Gemini 4的预训练,号称是”最雄心勃勃的训练跑”。
信号解读:两种可能
对于Pro的持续缺席,市场解读分化为两种声音。乐观派认为,Google正在将资源集中在Gemini 4上,用3.6 Flash系列维持中端市场,等Gemini 4一步到位实现反超。悲观派则认为,这暴露了Google在Scaling Law上的困境——当模型规模继续扩大时,性能增长的边际效益递减,传统的”更大即更好”路径正在遇到天花板。
不论真相如何,一个事实非常清晰:在AI大模型的军备竞赛中,速度本身就是一种能力。每一次跳票,都是在给竞争对手多一个身位的领先。
对开发者的实际影响
抛开战略博弈不谈,3.6 Flash的17% Token成本降低对开发者来说是实打实的好处。如果你正在用Gemini API构建Agent应用,迁移到3.6 Flash意味着在相同预算下可以处理更多的用户请求——对于月调用量在百万Token级别的应用来说,一年省下的费用相当可观。
而Flash Cyber的发布则揭示了另一个趋势:AI安全正在从”防御AI”转向”用AI做防御”。将模型专门微调用于漏洞发现,相当于给安全团队配备了一个不知疲倦的自动化渗透测试员。不过目前仅限政府和可信伙伴使用,普通开发者暂时只能观望。
Google还能追回来吗?答案可能要到Gemini 4落地那天才能揭晓。
👇 关注不错过,LC智趣厅持续追踪AI大模型风云
— END —
LC 智趣厅 · 科技与生活的交点
ihygg.cn
