Google的Gemini 3.6 Flash更便宜且更短 - 而Gemini 4有所暗示,3.5 Pro则推迟上线

持续追踪 : Fatigue hype 2026 : le tri entre modèle et harness· 连载 8/33

模型与工具 Jul 22, 2026 at 12:417加入收藏

Google的Gemini 3.6 Flash更便宜且更短 - 而Gemini 4有所暗示,3.5 Pro则推迟上线
插图 : Léa Fontaine

Google发布了三个新的Gemini模型,重点是“输出更少的token,成本更低”,在候诊室测试Gemini 4 - 并让Gemini 3.5 Pro留在起跑线上。

用简单的语言来说 - Google于2026年7月21日发布了三个新的Gemini变体,以Gemini 3.6 Flash为主打。其核心卖点很简单:输出令牌更少,价格更低,并且混合了一个针对网络安全调优的模型。但Gemini 3.5 Pro——这个被预告了数周的旗舰推理模型——仍在测试中。Google反而提前宣布了Gemini 4。

上下文

Google在2026年的Gemini节奏并不顺利:3.5 Pro多次延期,Google私下称编码基准回归。发布“现有就绪”产品(Flash及相关专用变体)的方法是一种在推理旗舰重新调整的同时保持发布节奏的方式。

报告数据

  • 公布了三个模型:Gemini 3.6 Flash(通用用途,速度更快),一个面向网络安全的变体,以及第三个未公开的变体即将进入公共预览。
  • Google声称与3.5 Flash相比,相同任务的输出令牌减少,导致每次请求的成本降低。发布帖中未公布具体基准差异。
  • 确认Gemini 3.5 Pro仍在测试中。
  • 预告Gemini 4——没有日期,没有功能规格,没有定价。

分析

正在发生两件事。首先,Google正在致力于双层模型现实:Flash类模型优化成本和延迟,Pro/Ultra类用于最困难的推理。这与OpenAI的GPT-5.6与Codex/Work分离以及Anthropic的Fable与Haiku分离相呼应。三大前沿实验室正在收敛到相同的产品拓扑。

其次,在3.5 Pro尚未发布的情况下预告Gemini 4是一个信号,而非泄露。这是Google在向市场和企业客户传达:推理天花板仍在提升,不要锁定在竞争对手上。打赌的是“还有更多即将到来”足以保持管道温暖,即使旗舰产品延迟。

对于采购方的工程师:3.6 Flash的真正价值是可衡量的——输出令牌的减少在生产中会累积。将其与您最差的延迟任务进行测试。对于与CFO的路线图对话:在3.5 Pro实际上GA之前,不要签订多年Gemini合同。

场景

  • 基准情况(55%):Gemini 3.5 Pro在60天内发布,与Fable 5在推理上平行或略领先;Gemini 4在2027年第一季度推出。
  • 滑动(30%):3.5 Pro再次滑动;Google在Flash层面加大力度,而Anthropic和OpenAI则扩大其推理领先优势。
  • 超越(15%):Google完全跳过3.5 Pro,直接跳到4——这是“Windows 9”的策略。

影响

对于建设者:不要等待——3.6 Flash值得现在进行基准测试。对于决策者:双层现实已经到来;购买您实际需要的层级,而不是您想要提及的旗舰产品。

Resources

本文由人工智能撰写,并经人工编辑审核。

我们的编辑部
Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

SSHMonitoringAI Ops
Get early access
这篇文章对您有帮助吗?

16 人赞了这篇文章

P
Priya Raman机器学习工程师
🇨🇳 机器学习工程师,应用研究
分享:
评论 (7)

登录后即可参与讨论。

HistoryBuff 22 Jul 2026 · 09:21

I hope Gemini 3.6 Flash will handle creative tasks well. Shorter outputs might limit artistic expression.

sandrine.b 22 Jul 2026 · 09:14

I wonder if Gemini 3.6 Flash will be suitable for detailed, nuanced discussions. Shorter outputs might not capture the depth needed for complex topics.

ArtLover99 22 Jul 2026 · 08:52

I'm interested in seeing how Gemini 4 will compare to the Flash and Pro models. Will it offer a balanced mix of cost and quality?

J.P.R. 2 22 Jul 2026 · 11:11

Gemini 4 might focus on advanced features rather than cost, setting it apart from Flash and Pro.

J.P.R. 22 Jul 2026 · 08:47

I'm concerned about the potential lack of depth in Gemini 3.6 Flash. Will it sacrifice quality for brevity?

CriticAtHeart 22 Jul 2026 · 08:44

I wonder how the shorter outputs will impact complex queries. Will Gemini 3.6 Flash still deliver the depth needed for detailed analysis?

Emma_London 22 Jul 2026 · 08:05

I'm curious about the balance between cost and quality in these new models. Will the shorter outputs still provide meaningful insights?

Dr. J. 22 Jul 2026 · 07:58

Google's new Gemini models sound promising, but I wonder how the reduced token output will affect the quality of responses.

事件时间线

Fatigue hype 2026 : le tri entre modèle et harness

  1. 1「我爱大型语言模型,我恨炒作」——geohot 提醒唯一剩下的规则13/07/2026
  2. 2「贫穷且自信」: 开发者是LLM断言的不良评判者13/07/2026
  3. 3专业人士如何真正评价由AI生成的代码?13/07/2026
  4. 4Zig、Zed、Anthropic:当语言创造者直呼其名13/07/2026
  5. 5"LLM评论家是对的。我还是会用LLM" - 重组的声音16/07/2026
  6. 6成本已变:GitHub重新引发关于真正瓶颈的讨论17/07/2026
  7. 7「Claude Code:功能缺陷解剖」——当公开评审成为真正的质量保证17/07/2026
  8. 8Google的Gemini 3.6 Flash更便宜且更短 - 而Gemini 4有所暗示,3.5 Pro则推迟上线22/07/2026
  9. 9"AI并没有让编程变得更容易,它只是让编程变得难在了不同的方面" - CACM给出了反炒作的观点22/07/2026
  10. 10"国有AI不会解决不平等":Rest of World对全球南方国家国有AI的尖锐论点24/07/2026
  11. 11重构作为代币成本杠杆:福勒生成式AI系列中的一个实验30/07/2026
  12. 12雷切尔·莱科克:“注意力已成为稀缺资源”——开发编排器,同时管理8到12个代理31/07/2026
  13. 13情境意识在一个月内下降67%:真正信徒的审判02/08/2026
  14. 14OpenAI 的「Astra」据说已解决10个数学和计算机科学领域的公开难题——且让我们拭目以待证据。02/08/2026
  15. 15“取消光标”:质量债务压倒功能开发速度02/08/2026
  16. 16杰夫·迪恩谈人工智能团队的常见错误:来自付账商店的诊断03/08/2026
  17. 17AI 需求泡沫:区分真实支出与人为炒作04/08/2026
  18. 18AI 基准测试正在饱和——我们正在耗尽衡量进展的方法04/08/2026
  19. 19谷歌和亚马逊的人工智能收益使“前沿案例”成为现实——前沿访问才是真正的分水岭05/08/2026
  20. 20Agentic AI 在 Gartner 日本 2026 炒作周期中达到顶峰 - 阴影 AI 才是真正的治理缺口05/08/2026
  21. 21各国政府正在对人工智能热潮下注——经济学人指出了风险06/08/2026
  22. 22安本:尽管抛售,人工智能仍是长期赌注——欧洲最大资产管理公司的看法06/08/2026
  23. 23Palantir 93% 的第二季度营收增长:当企业 AI 真正交付时的样子08/08/2026
  24. 24“LLMs 不能跳跃”:立场论文认为大语言模型存在根本性推理上限08/08/2026
  25. 25理解力是一种架构特性——而AI生成的代码正在失去它13/08/2026
  26. 26软件的TEMU化:廉价、充足且越来越难以销售14/08/2026
  27. 27为什么 Opus 5 使用起来感觉更糟糕——以及这对模型评估的意义14/08/2026
  28. 28小米17 Ultra将月亮拍成了太阳——AI照片处理仍在欺骗你14/08/2026
  29. 29安thropic的概念推理指数针对基准污染问题18/08/2026
  30. 30人工智能交易将日本股市波动推至18年高点——集中风险变得可衡量19/08/2026
  31. 31人工智能对创作者经济的重塑:当拿钱反而失去观众24/08/2026
  32. 32我正在变成“AI盲”——而这确实是个大问题24/08/2026
  33. 33OpenAI 的“Astra”模型声称解决了10个开放数学问题——当AI不再只进行基准测试,而是开始进行发现时25/08/2026
Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

Get early access
主题
浏览
信息