AMAZINGINDEX.COM 日报快照
56.9
VOL. 2026.07
2026.07.22
← 返回 2026.07.22 日报
日报快照 · Daily Snapshot
NO. 012

谷歌三连发:Flash模型全线降价提效

#ARTICLE HackerNews 2026.07.22
推荐指数 63.0 NO. 012 · 2026.07.22
发布2026/07/21Score421Comments341

谷歌发布 Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber 三款模型,主打 token 效率与延迟优化。对跑 agent 工作流的团队来说,3.6 Flash 输出 token 成本更低且编码能力显著提升,3.5 Flash-Lite 则是极致性价比选项。

3.5 Flash Cyber 这个命名暗示谷歌在推垂直场景专用模型,Cyber 大概率指向安全/代码审计方向,这是 OpenAI 没有明确布局的切口。Flash-Lite 的 350 token/s 输出速度如果属实,已经接近 Groq 的水平,但 Groq 的硬件成本结构完全不同,谷歌这是在用规模压价抢实时场景。

真正值得盯的是 3.6 Flash 的 65% token 削减——这不是简单的模型变聪明,而是输出风格被强制压缩了。实际落地时要测你的 agent 是否还能保持足够的解释性输出,别为了省钱让调试变噩梦。建议先用 DeepSWE 类似的 benchmark 跑自己的代码生成任务,看 token 削减是否以牺牲可读性为代价。

意见分歧 305 条评论

核心争论:降价提效是否足以弥补与开源模型及中国模型的性能差距

yanis_t

The benchmarks are not particularly impressive. I suppose they needed to release something since the long pause. But not clear why would I use it now.

dumberquestions

"..and in some benchmarks like DeepSWE by Datacurve, we observe up to 65%, all at a lower cost per output token." "3.6 Flash delivers higher precision with fewer unwanted code edits and reduced execution loops, as seen in DeepSWE (49% vs. 37%)" So which one is it? 65% or 49%?

petu

First sentence is about token efficiency.

替代方案: GLM-5.2ClaudeChinese open models
查看原文 →