谷歌推Gemini 3.7 Flash:距上代仅3周,输入输出价格直接腰斩,编程Agent场景要变天

· 科技资讯

谷歌又出手了。当地时间 8 月 13 日,谷歌正式发布 Gemini 3.7 Flash,距离上一代 3.6 Flash 发布只有大约三周。更狠的是价格:输入每百万 Token 0.75 美元、输出每百万 Token 3.75 美元,直接砍到 3.6 Flash 的一半,优惠价持续到 2026 年 12 月 31 日。

谷歌推Gemini 3.7 Flash:距上代仅3周,输入输出价格直接腰斩,编程Agent场景要变天封面

为什么这次迭代这么快

谷歌官方解释,这次版本直接源于开发者反馈和一系列算法创新。3.7 Flash 专门为编程与 Agents 场景打造,在软件工程、知识工作、网页开发工作流上都有大幅提升。换句话说,谷歌不是挤牙膏,而是在跟 OpenAI、Anthropic 抢最肥的开发者市场。

定价对比:3.6 Flash 输入 1.5 美元/百万 Token、输出 7.5 美元/百万 Token;3.7 Flash 直接打五折。对调用量大的开发者来说,这意味着同样的预算能跑两倍的 Token,或者把 Agent 的推理成本直接砍半。按一天 1000 万输入 Token + 200 万输出 Token 的中型应用算,一天成本从 3 万美元降到 1.5 万美元,一年省下 500 多万美元——这不是小钱。

谁现在就能用

即日起,面向 160 多个国家和地区的 Google AI Pro 及 Ultra 订阅用户推出的 Gemini Spark 正式接入 3.7 Flash,知识工作处理效率和 Workspace 工具调用能力都有提升。API 用户同样可以切换。另外,3.7 Flash 还新增了安全防御机制,重点防范化学、生物、放射性及核(CBRN)领域和网络攻击的滥用,同时保证合法应用不受影响——这背后是监管压力下大厂越来越谨慎的信号。

和国产模型的性价比对比

这个价位放到中国市场也很有竞争力:DeepSeek、Kimi 等国产模型主打每百万 Token 输入 1 元人民币级别的低价,Gemini 3.7 Flash 输入 0.75 美元(约 5.1 元)不算最便宜,但优势在于输出质量稳定、与 Workspace/Android 生态打通,以及年底前锁定的折扣价。适合的场景:跨国业务、需要 Google 生态集成的产品、以及希望降低对单一国产模型依赖的团队。

对开发者意味着什么

1. 成本敏感型应用:如果只是做简单问答、内容分类,3.7 Flash 性价比直接拉满。

2. Agent 型产品:多轮工具调用、代码生成场景,半价意味着可以放开推理预算,跑更多轮自我纠错。

3. 需要谨慎的点:新模型刚上线,评测数据还不完整,生产环境建议先灰度,把 3.7 和 3.6 的线上表现做 A/B。

给中文开发者的行动清单

– 今天就能做:去 Google AI Studio 或 Vertex AI 把模型切换到 gemini-3.7-flash,跑一轮现有测试集,对比 3.6 的准确率和延迟。

– 本周做:算一笔账——把最近 7 天的 Token 用量按新旧价格各算一遍,看能省多少;省下的预算可以投入到更多 Agent 推理轮次。

– 长期看:别把鸡蛋放一个篮子。谷歌、OpenAI、Anthropic、国产模型都在打价格战,保持多模型路由能力,谁便宜用谁。

一个更值得注意的趋势:谷歌把”最快迭代 + 最低价”当成组合拳打,这已经不是模型能力竞赛,而是成本与迭代速度的军备竞赛。对普通开发者,现在反而是红利期——模型越来越便宜,可选的越来越多了。

🔥 关注LC智趣厅,第一时间看懂 AI 圈的大新闻。

👇 关注不错过,每一条都帮你算清楚”跟我有什么关系”。


— END —
LC 智趣厅 · 科技与生活的交点
ihygg.cn

Scroll to Top
微信公众号:LC智趣厅

扫码关注微信公众号
LC智趣厅