El Gemini 3.6 Flash de Google es más económico y breve, y se insinúa el Gemini 4 mientras que el 3.5 Pro sigue en desarrollo

Seguimiento del caso : Fatigue hype 2026 : le tri entre modèle et harness· Episodio 8/16

Modelos y Herramientas Jul 22, 2026 at 12:417Añadir a favoritos

El Gemini 3.6 Flash de Google es más económico y breve, y se insinúa el Gemini 4 mientras que el 3.5 Pro sigue en desarrollo
Ilustración : Léa Fontaine

Google publica tres nuevos modelos Gemini con enfoque en «menos tokens de salida, más barato», prueba Gemini 4 en la sala de espera —y mantiene a Gemini 3.5 Pro en la línea de partida.

En términos sencillos - Google lanzó tres nuevas variantes de Gemini el 21 de julio de 2026, encabezadas por Gemini 3.6 Flash. La propuesta es clara: menos tokens de salida, precios más bajos y un modelo ajustado para ciberseguridad en la mezcla. Pero Gemini 3.5 Pro —el modelo insignia de razonamiento anunciado durante semanas— sigue en pruebas. Google, en cambio, está preanunciando Gemini 4.

Contexto

Google's Gemini cadence in 2026 has been rough: 3.5 Pro slipped multiple times, with Google privately citing coding-benchmark regressions. The launch-what-is-ready-now approach (Flash, plus adjacent specialised variants) is a way to keep the release drumbeat going while the reasoning flagship is retooled.

Datos reportados

  • Tres modelos anunciados: Gemini 3.6 Flash (propósito general, más rápido), una variante orientada a ciberseguridad y una tercera variante no revelada que llegará a vista previa pública.
  • Google afirma que reduce los tokens de salida para tareas equivalentes en comparación con 3.5 Flash, lo que se traduce en un menor costo por solicitud. No se publicaron diferencias exactas en los puntos de referencia en la publicación del lanzamiento.
  • Se confirma que Gemini 3.5 Pro sigue en pruebas.
  • Se menciona Gemini 4 —sin fecha, especificaciones de capacidades ni precios.

Análisis

Están ocurriendo dos cosas al mismo tiempo. Primero, Google se compromete con una realidad de modelos de dos niveles: modelos de clase Flash optimizados para costo y latencia, y modelos Pro/Ultra para el razonamiento más complejo. Esto refleja la división de OpenAI entre GPT-5.6 y Codex/Work, y la de Anthropic entre Fable y Haiku. Los tres laboratorios líderes están convergiendo en la misma topología de productos.

Segundo, el preanuncio de Gemini 4 mientras 3.5 Pro no está disponible es una señal, no una filtración. Es Google diciendo a los mercados y compradores empresariales: "el techo del razonamiento sigue subiendo, no se queden con la competencia". La apuesta es que "vendrá más" es suficiente para mantener el interés incluso cuando el modelo insignia llega tarde.

Para ingenieros en el lado comprador: el valor real de 3.6 Flash es medible —la reducción de tokens de salida se acumula en producción. Pruébenlo con sus peores tareas de latencia. Para la conversación sobre la hoja de ruta con un CFO: no firmen contratos multianuales de Gemini hasta que 3.5 Pro esté realmente disponible de forma general.

Escenarios

  • Caso base (55%): Gemini 3.5 Pro se lanza en un plazo de 60 días con paridad o ligera ventaja frente a Fable 5 en razonamiento; Gemini 4 llega en el primer trimestre de 2027.
  • Retraso (30%): 3.5 Pro vuelve a retrasarse; Google se apoya más en la clase Flash mientras Anthropic y OpenAI extienden su ventaja en razonamiento.
  • Salto adelante (15%): Google omite 3.5 Pro por completo y pasa directamente a 4 —siguiendo el manual de "Windows 9".

Implicaciones

Para un desarrollador: no esperen —3.6 Flash vale la pena probarlo ahora. Para un tomador de decisiones: la realidad de dos niveles ya está aquí; compren el nivel que realmente necesitan, no el modelo insignia que les gustaría mencionar.

Resources

Artículo producido por inteligencia artificial, revisado bajo control editorial humano.

Nuestra redacción
Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

SSHMonitoringAI Ops
Get early access
¿Te ha resultado útil este artículo?

16 personas han valorado este artículo

Me gusta
P
Priya RamanMachine Learning Engineer
🇬🇧 ML engineer, applied research.
Compartir:
Comentarios (7)

Inicia sesión para unirte a la conversación.

HistoryBuff 22 Jul 2026 · 09:21

I hope Gemini 3.6 Flash will handle creative tasks well. Shorter outputs might limit artistic expression.

sandrine.b 22 Jul 2026 · 09:14

I wonder if Gemini 3.6 Flash will be suitable for detailed, nuanced discussions. Shorter outputs might not capture the depth needed for complex topics.

ArtLover99 22 Jul 2026 · 08:52

I'm interested in seeing how Gemini 4 will compare to the Flash and Pro models. Will it offer a balanced mix of cost and quality?

J.P.R. 2 22 Jul 2026 · 11:11

Gemini 4 might focus on advanced features rather than cost, setting it apart from Flash and Pro.

J.P.R. 22 Jul 2026 · 08:47

I'm concerned about the potential lack of depth in Gemini 3.6 Flash. Will it sacrifice quality for brevity?

CriticAtHeart 22 Jul 2026 · 08:44

I wonder how the shorter outputs will impact complex queries. Will Gemini 3.6 Flash still deliver the depth needed for detailed analysis?

Emma_London 22 Jul 2026 · 08:05

I'm curious about the balance between cost and quality in these new models. Will the shorter outputs still provide meaningful insights?

Dr. J. 22 Jul 2026 · 07:58

Google's new Gemini models sound promising, but I wonder how the reduced token output will affect the quality of responses.

El hilo del caso

Fatigue hype 2026 : le tri entre modèle et harness

  1. 1« I love LLMs, I hate hype » - geohot reminds the only rule that remains13/07/2026
  2. 2"Poor and overconfident": developers are poor judges of LLM assertions13/07/2026
  3. 3How do software professionals really judge the code generated by AI?13/07/2026
  4. 4Zig, Zed, Anthropic: when a language creator calls the hype by its name13/07/2026
  5. 5"Los críticos de los LLM tienen razón. Yo uso LLM de todos modos" - la voz que recomponen16/07/2026
  6. 6El costo de decir que sí ha cambiado: GitHub relanza el debate sobre el verdadero cuello de botella17/07/2026
  7. 7« Claude Code: Anatomía de una mala característica » - cuando la revisión pública se convierte en el verdadero QA17/07/2026
  8. 8El Gemini 3.6 Flash de Google es más económico y breve, y se insinúa el Gemini 4 mientras que el 3.5 Pro sigue en desarrollo22/07/2026
  9. 9La IA no hizo la programación más fácil, solo la hizo difícil de otra manera - CACM lanza la línea anti-hype22/07/2026
  10. 10"La IA estatal no resolverá la desigualdad": la tesis cruda de Rest of World sobre las IA nacionales del Sur global24/07/2026
  11. 11Refactorización como palanca de costo de tokens: un experimento en la serie de gen-AI de Fowler30/07/2026
  12. 12Rachel Laycock: «La atención se ha convertido en el recurso escaso» - el dev-orchestrator, entre 8 y 12 agentes en paralelo31/07/2026
  13. 13Situational Awareness pierde 67 % en un mes: el juicio de las verdaderas creyentes02/08/2026
  14. 14OpenAI « Astra » habría resuelto 10 problemas abiertos en matemáticas e informática: esperemos las pruebas02/08/2026
  15. 15« Cancelling Cursor »: la deuda técnica se antepone a la velocidad de las funcionalidades02/08/2026
  16. 16Jeff Dean sobre lo que los equipos de IA hacen mal: el diagnóstico de la tienda que paga cada factura03/08/2026
Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

Get early access
Secciones
Explorar
Información