谷歌三连发:Flash模型全线降价提效
推荐指数 63.0 NO. 012 · 2026.07.22
发布2026/07/21Score421Comments341
为什么值得看
谷歌发布 Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber 三款模型,主打 token 效率与延迟优化。对跑 agent 工作流的团队来说,3.6 Flash 输出 token 成本更低且编码能力显著提升,3.5 Flash-Lite 则是极致性价比选项。
编辑判断
3.5 Flash Cyber 这个命名暗示谷歌在推垂直场景专用模型,Cyber 大概率指向安全/代码审计方向,这是 OpenAI 没有明确布局的切口。Flash-Lite 的 350 token/s 输出速度如果属实,已经接近 Groq 的水平,但 Groq 的硬件成本结构完全不同,谷歌这是在用规模压价抢实时场景。
真正值得盯的是 3.6 Flash 的 65% token 削减——这不是简单的模型变聪明,而是输出风格被强制压缩了。实际落地时要测你的 agent 是否还能保持足够的解释性输出,别为了省钱让调试变噩梦。建议先用 DeepSWE 类似的 benchmark 跑自己的代码生成任务,看 token 削减是否以牺牲可读性为代价。
社区反馈
意见分歧 305 条评论
核心争论:降价提效是否足以弥补与开源模型及中国模型的性能差距
相关内容
谁还敢说谷歌掉队?2025年,它打了一场漂亮的翻身仗 Gemini 3 Flash综合质量超越Gemini 2.5 Pro,成本大幅降低,延迟显著优化,体现谷歌高性价比策略。 劈柴哥深度解析:谷歌AI的“长期主义”与Gemini 3如何引领下一轮 谷歌采取每半年重大突破机制,着重发展兼顾性能、速度和成本的Flash模型,优先规模化部署AI能力。 直击 Google I/O 2026 | 轰炸式发布 Agent,狙击 Claude Code,开战! Gemini降价策略:新增100美元/月Ultra档,原250美元顶级档降至200美元,Pro维持19.99美元/月。 前端铺开智能体,后端猛砸TPU:直击谷歌I/O大会 Flash模型定价调整,Gemini 3.5 Flash综合分数低于Gemini 3.1 Pro,性价比引发关注。
The benchmarks are not particularly impressive. I suppose they needed to release something since the long pause. But not clear why would I use it now.
"..and in some benchmarks like DeepSWE by Datacurve, we observe up to 65%, all at a lower cost per output token." "3.6 Flash delivers higher precision with fewer unwanted code edits and reduced execution loops, as seen in DeepSWE (49% vs. 37%)" So which one is it? 65% or 49%?
First sentence is about token efficiency.