O Google's Gemini 3.6 Flash é mais barato e mais curto - e o Gemini 4 ganha um teaser enquanto o 3.5 Pro continua atrasado

Seguimento do caso : Fatigue hype 2026 : le tri entre modèle et harness· Episódio 8/16

Modelos e Ferramentas Jul 22, 2026 at 12:417Adicionar aos favoritos

O Google's Gemini 3.6 Flash é mais barato e mais curto - e o Gemini 4 ganha um teaser enquanto o 3.5 Pro continua atrasado
Ilustração : Léa Fontaine

O Google publicou três novos modelos Gemini com foco em "menos tokens de saída, mais barato", testou o Gemini 4 na sala de espera — e manteve o Gemini 3.5 Pro na linha de partida.

Em termos simples - O Google lançou três novas variantes do Gemini em 21 de julho de 2026, com destaque para o Gemini 3.6 Flash. A proposta é direta: menos tokens de saída, preços mais baixos e um modelo ajustado para cibersegurança na mistura. Mas o Gemini 3.5 Pro - o modelo de raciocínio topo de linha que foi teaseado por semanas - ainda está em fase de testes. O Google está, em vez disso, pré-anunciando o Gemini 4.

Contexto

O ritmo do Gemini do Google em 2026 tem sido difícil: o 3.5 Pro atrasou várias vezes, com o Google citando, em caráter privado, regressões em benchmarks de programação. A abordagem de lançar o que está pronto agora (Flash, além de variantes especializadas adjacentes) é uma forma de manter o ritmo de lançamentos enquanto o modelo de raciocínio topo de linha é reajustado.

Dados reportados

  • Três modelos anunciados: Gemini 3.6 Flash (propósito geral, mais rápido), uma variante orientada para cibersegurança e uma terceira variante não divulgada a caminho da visualização pública.
  • O Google alega redução de tokens de saída para tarefas equivalentes em comparação com o 3.5 Flash, o que se traduz em menor custo por solicitação. As deltas exatas de benchmarks não foram publicadas na postagem de lançamento.
  • O Gemini 3.5 Pro está confirmado como ainda em fase de testes.
  • O Gemini 4 é teaseado - sem data, sem especificação de capacidade, sem preço.

Análise

Duas coisas estão acontecendo ao mesmo tempo. Primeiro, o Google está se comprometendo com uma realidade de modelo de duas camadas: modelos da classe Flash otimizados para custo e latência, e modelos Pro/Ultra para os raciocínios mais complexos. Isso reflete a divisão do GPT-5.6 vs Codex/Work da OpenAI e a divisão Fable vs Haiku da Anthropic. Os três laboratórios de fronteira estão convergindo para a mesma topologia de produto.

Segundo, o tease do Gemini 4 enquanto o 3.5 Pro não está disponível é um sinal, não um vazamento. É o Google dizendo aos mercados e compradores empresariais: o teto do raciocínio ainda está em movimento, não se prenda aos concorrentes. A aposta é que "há mais por vir" é suficiente para manter o pipeline aquecido mesmo quando o modelo topo de linha está atrasado.

Para engenheiros do lado da compra: o valor real do 3.6 Flash é mensurável - a redução de tokens de saída se multiplica na produção. Teste-o em suas piores tarefas de latência. Para a conversa sobre o roadmap com um CFO: não assine contratos multianuais do Gemini até que o 3.5 Pro esteja realmente disponível.

Cenários

  • Caso base (55%) : O Gemini 3.5 Pro é lançado em até 60 dias com paridade ou pequena vantagem em relação ao Fable 5 em raciocínio; o Gemini 4 chega no Q1 de 2027.
  • Atraso (30%) : O 3.5 Pro atrasa novamente; o Google aposta mais na classe Flash enquanto a Anthropic e a OpenAI estendem sua vantagem em raciocínio.
  • Superação (15%) : O Google pula o 3.5 Pro e vai direto para o 4 - seguindo a cartilha do "Windows 9".

Implicações

Para um desenvolvedor: não espere - vale a pena testar o 3.6 Flash agora. Para um tomador de decisão: a realidade de duas camadas está aqui; compre a camada de que você realmente precisa, não o modelo topo de linha que gostaria de nomear.

Resources

Artigo produzido por inteligência artificial, revisto sob controlo editorial humano.

A nossa redação
Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

SSHMonitoringAI Ops
Get early access
Este artigo foi-lhe útil?

16 pessoas gostaram deste artigo

Gosto
P
Priya RamanMachine Learning Engineer
🇬🇧 ML engineer, applied research.
Partilhar:
Comentários (7)

Inicie sessão para se juntar à discussão.

HistoryBuff 22 Jul 2026 · 09:21

I hope Gemini 3.6 Flash will handle creative tasks well. Shorter outputs might limit artistic expression.

sandrine.b 22 Jul 2026 · 09:14

I wonder if Gemini 3.6 Flash will be suitable for detailed, nuanced discussions. Shorter outputs might not capture the depth needed for complex topics.

ArtLover99 22 Jul 2026 · 08:52

I'm interested in seeing how Gemini 4 will compare to the Flash and Pro models. Will it offer a balanced mix of cost and quality?

J.P.R. 2 22 Jul 2026 · 11:11

Gemini 4 might focus on advanced features rather than cost, setting it apart from Flash and Pro.

J.P.R. 22 Jul 2026 · 08:47

I'm concerned about the potential lack of depth in Gemini 3.6 Flash. Will it sacrifice quality for brevity?

CriticAtHeart 22 Jul 2026 · 08:44

I wonder how the shorter outputs will impact complex queries. Will Gemini 3.6 Flash still deliver the depth needed for detailed analysis?

Emma_London 22 Jul 2026 · 08:05

I'm curious about the balance between cost and quality in these new models. Will the shorter outputs still provide meaningful insights?

Dr. J. 22 Jul 2026 · 07:58

Google's new Gemini models sound promising, but I wonder how the reduced token output will affect the quality of responses.

O fio do caso

Fatigue hype 2026 : le tri entre modèle et harness

  1. 1« I love LLMs, I hate hype » - geohot reminds the only rule that remains13/07/2026
  2. 2"Poor and overconfident": developers are poor judges of LLM assertions13/07/2026
  3. 3How do software professionals really judge the code generated by AI?13/07/2026
  4. 4Zig, Zed, Anthropic: when a language creator calls the hype by its name13/07/2026
  5. 5Os críticos de LLMs estão certos. Eu uso LLMs mesmo assim16/07/2026
  6. 6O custo de dizer sim mudou: GitHub relança o debate sobre o verdadeiro gargalo17/07/2026
  7. 7« Código Claude: Anatomia de uma Má-Feature » - quando a revisão pública se torna o verdadeiro QA17/07/2026
  8. 8O Google's Gemini 3.6 Flash é mais barato e mais curto - e o Gemini 4 ganha um teaser enquanto o 3.5 Pro continua atrasado22/07/2026
  9. 9A IA não tornou a programação mais fácil, apenas a tornou difícil de outra forma - CACM acerta na frase anti-hype22/07/2026
  10. 10"As IA estatal não resolverá a desigualdade": a tese crua do Rest of World sobre as IAs nacionais do Sul Global24/07/2026
  11. 11Refatoração como alavanca de custo de token: um experimento na série de gen-AI de Fowler30/07/2026
  12. 12Rachel Laycock: "a atenção tornou-se o recurso raro" - o dev-orquestrador, entre 8 e 12 agentes em paralelo31/07/2026
  13. 13Situational Awareness perde 67 % em um mês: o julgamento das verdadeiras crentes02/08/2026
  14. 14OpenAI « Astra » teria resolvido 10 problemas abertos em matemática e ciência da computação — aguardemos as provas02/08/2026
  15. 15« Cancelling Cursor »: a dívida técnica sobrepõe-se à velocidade de entrega de funcionalidades02/08/2026
  16. 16Jeff Dean sobre o que as equipes de IA erram: o diagnóstico da oficina que paga todas as contas03/08/2026
Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

Get early access
Secções
Explorar
Informações