Модели и инструменты Jul 22, 2026 at 12:417В закладки

Google публикует три новые модели Gemini с акцентом на «меньше токенов на выходе, дешевле», тестирует Gemini 4 в приёмной — и оставляет Gemini 3.5 Pro на стартовой линии.
Простыми словами - 21 июля 2026 года Google выпустила три новые версии Gemini, среди которых headline-новинка — Gemini 3.6 Flash. Задача проста: меньше токенов вывода, более низкие цены и модель, настроенная на кибербезопасность. Однако Gemini 3.5 Pro — флагманская модель для рассуждений, которую анонсировали за несколько недель до этого, всё ещё находится на стадии тестирования. Вместо этого Google заранее анонсировала Gemini 4.
В 2026 году темпы выпуска Gemini у Google были неровными: 3.5 Pro несколько раз откладывался, и в компании в частном порядке ссылались на регрессии в бенчмарках для программирования. Подход «выпускаем то, что готово» (Flash и близкие специализированные версии) позволяет поддерживать ритм релизов, пока флагманская модель для рассуждений дорабатывается.
Происходят сразу две вещи. Во-первых, Google переходит к двухъярусной модели: модели класса Flash оптимизированы по стоимости и задержкам, а Pro/Ultra — для самых сложных задач на рассуждение. Это напоминает разделение OpenAI на GPT-5.6 и Codex/Work, а также подход Anthropic с Fable и Haiku. Три ведущие лаборатории сходятся в одной продуктовой топологии.
Во-вторых, анонс Gemini 4 при том, что 3.5 Pro ещё не выпущен, — это сигнал, а не утечка. Google сообщает рынкам и корпоративным клиентам: потолок возможностей для рассуждений всё ещё растёт, не стоит фиксироваться на конкурентах. Ставка делается на то, что обещание «скоро выйдет что-то новое» достаточно, чтобы поддерживать интерес, даже когда флагман задерживается.
Для инженеров на стороне покупателя реальная ценность 3.6 Flash измерима — сокращение токенов вывода даёт эффект в производстве. Протестируйте её на самых проблемных задачах с задержками. Для обсуждения дорожной карты с финансовым директором: не подписывайте долгосрочные контракты на Gemini, пока 3.5 Pro не станет общедоступным.
Для разработчика: не ждите — 3.6 Flash стоит протестировать уже сейчас. Для лица, принимающего решения: двухъярусная реальность уже здесь; покупайте тот ярус, который вам действительно нужен, а не флагман, который вы хотите упомянуть ради громкого названия.
Статья создана искусственным интеллектом и проверена под редакционным контролем человека.
Войдите, чтобы участвовать в обсуждении.
I hope Gemini 3.6 Flash will handle creative tasks well. Shorter outputs might limit artistic expression.
I wonder if Gemini 3.6 Flash will be suitable for detailed, nuanced discussions. Shorter outputs might not capture the depth needed for complex topics.
I'm interested in seeing how Gemini 4 will compare to the Flash and Pro models. Will it offer a balanced mix of cost and quality?
Gemini 4 might focus on advanced features rather than cost, setting it apart from Flash and Pro.
I'm concerned about the potential lack of depth in Gemini 3.6 Flash. Will it sacrifice quality for brevity?
I wonder how the shorter outputs will impact complex queries. Will Gemini 3.6 Flash still deliver the depth needed for detailed analysis?
I'm curious about the balance between cost and quality in these new models. Will the shorter outputs still provide meaningful insights?
Google's new Gemini models sound promising, but I wonder how the reduced token output will affect the quality of responses.
Fatigue hype 2026 : le tri entre modèle et harness