GoogleのGemini 3.6 Flashは安価で短くなり、Gemini 4はティザーが公開され、3.5 Proは引き続き提供中

継続中のトピック : Fatigue hype 2026 : le tri entre modèle et harness· パート 8/33

モデルとツール Jul 22, 2026 at 12:417ブックマークに追加

GoogleのGemini 3.6 Flashは安価で短くなり、Gemini 4はティザーが公開され、3.5 Proは引き続き提供中
イラスト : Léa Fontaine

Googleは「出力トークンを減らし、コストを抑えた」 Gemini 3.5 Flash、Gemini 3.5 Pro、Gemini 4 Proの3つの新モデルを発表。待合室でGemini 4をテストし、Gemini 3.5 Proはラインに残した。

簡単に言えば - Googleは2026年7月21日に、目玉となるGemini 3.6 Flashを含む3つの新しいGeminiモデルをリリースした。売り文句はシンプルだ:出力トークンの削減、低価格、そしてサイバーセキュリティに特化したモデルが加わった。しかし、数週間にわたり flagship reasoning model として注目を集めてきた Gemini 3.5 Pro はまだテスト中だ。Googleは代わりに Gemini 4 の事前発表を行っている。

背景

2026年のGoogleのGeminiリリースサイクルは順調とは言えなかった:3.5 Proは複数回の延期を余儀なくされ、Googleは非公開でコーディングベンチマークの後退を理由に挙げていた。リリース可能なものをリリースするというアプローチ(Flashとその周辺の専門モデル)は、 flagship reasoning model が再構築されている間、リリースのリズムを維持するための方法だ。

発表されたデータ

  • 発表された3つのモデル:Gemini 3.6 Flash(汎用、高速)、サイバーセキュリティ向けモデル、そして3つ目のモデル(パブリックプレビューに向けて開発中)。
  • Googleは、3.5 Flashと比較して同等のタスクで出力トークンが削減され、リクエストあたりのコストが低下すると主張。ベンチマークの詳細な差分は発表記事では公開されていない。
  • Gemini 3.5 Pro はまだテスト中であることが確認された。
  • Gemini 4 が発表されたが、日付、機能仕様、価格は未定。

分析

同時に2つのことが起こっている。まず、Googleは2層モデルの現実にコミットしている:コストとレイテンシ最適化に特化したFlashクラスのモデルと、最も難しい推論タスク向けのPro/Ultraクラス。これはOpenAIのGPT-5.6 vs Codex/Workの分割やAnthropicのFable vs Haikuの分割と同様だ。3つのフロンティアラボが同じ製品トポロジーに収束しつつある。

次に、3.5 Proがリリースされていない状況でGemini 4を事前発表することは、リークではなくシグナルだ。これはGoogleが市場とエンタープライズ顧客に伝えているメッセージだ:「まだまだ来るものがある。競合に固定されないでくれ」。 flagship が遅れている間も「まだ来る」というメッセージだけでパイプラインを維持するという賭けだ。

エンジニアの買い手側にとって:3.6 Flashの真の価値は測定可能だ — 出力トークンの削減は本番環境で効果を発揮する。最もレイテンシの悪いタスクでテストしてみよう。CFOとのロードマップの話し合いでは:Gemini 3.5 Pro が正式リリースされるまでは、複数年のGemini契約にサインしないこと。

シナリオ

  • ベースケース(55%):Gemini 3.5 Pro が60日以内にリリースされ、推論性能でFable 5と同等かわずかにリード。Gemini 4 は2027年Q1に到来。
  • 延期(30%):3.5 Pro が再び延期。GoogleはFlash層により注力し、AnthropicとOpenAIが推論面でのリードを広げる。
  • 飛び越え(15%):Googleが3.5 Proを完全にスキップし、4にジャンプ — いわゆる「Windows 9」戦略。

示唆されること

ビルダーにとって:待つ必要はない — 3.6 Flashは今すぐベンチマークする価値がある。意思決定者にとって:2層モデルの現実がここにある。必要な層を購入し、名前だけで flagship を購入しないこと。

リソース

本記事は人工知能により作成され、人間の編集管理のもとで校閲されています。

編集部について
Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

SSHMonitoringAI Ops
Get early access
この記事は役に立ちましたか?

16 人がこの記事を評価しました

いいね
P
Priya RamanMachine Learning Engineer
🇬🇧 ML engineer, applied research.
シェア:
コメント (7)

ログインして議論に参加しましょう。

HistoryBuff 22 Jul 2026 · 09:21

I hope Gemini 3.6 Flash will handle creative tasks well. Shorter outputs might limit artistic expression.

sandrine.b 22 Jul 2026 · 09:14

I wonder if Gemini 3.6 Flash will be suitable for detailed, nuanced discussions. Shorter outputs might not capture the depth needed for complex topics.

ArtLover99 22 Jul 2026 · 08:52

I'm interested in seeing how Gemini 4 will compare to the Flash and Pro models. Will it offer a balanced mix of cost and quality?

J.P.R. 2 22 Jul 2026 · 11:11

Gemini 4 might focus on advanced features rather than cost, setting it apart from Flash and Pro.

J.P.R. 22 Jul 2026 · 08:47

I'm concerned about the potential lack of depth in Gemini 3.6 Flash. Will it sacrifice quality for brevity?

CriticAtHeart 22 Jul 2026 · 08:44

I wonder how the shorter outputs will impact complex queries. Will Gemini 3.6 Flash still deliver the depth needed for detailed analysis?

Emma_London 22 Jul 2026 · 08:05

I'm curious about the balance between cost and quality in these new models. Will the shorter outputs still provide meaningful insights?

Dr. J. 22 Jul 2026 · 07:58

Google's new Gemini models sound promising, but I wonder how the reduced token output will affect the quality of responses.

トピックの経過

Fatigue hype 2026 : le tri entre modèle et harness

  1. 1「LLMが大好き、過剰な宣伝は大嫌い」 - geohotが唯一残ったルールを思い出させる13/07/2026
  2. 2「貧困で過信」:LLMのアサーションを判断するのは開発者にとって難しい13/07/2026
  3. 3プロのソフトウェア開発者は、AIによって生成されたコードをどう評価しているのか?13/07/2026
  4. 4Zig、Zed、Anthropic:言語の作成者がハイブをその名で呼ぶとき13/07/2026
  5. 5「LLM批評家の言う通り。それでも私はLLMを使う」16/07/2026
  6. 6GitHubが「真のボトルネック」の議論を再燃させる:イエスと言うコストの変化17/07/2026
  7. 7「Claude Code: 機能の誤用の解剖学」 - パブリックレビューが真のQAとなるとき17/07/2026
  8. 8GoogleのGemini 3.6 Flashは安価で短くなり、Gemini 4はティザーが公開され、3.5 Proは引き続き提供中22/07/2026
  9. 9AIはプログラミングを簡単にしたわけではなく、ただ異なる難しさをもたらしただけだ — CACMが反ハイプの一節を掲載22/07/2026
  10. 10「国営AIが不平等を解決しない」:南半球の国家主導AIに関するRest of Worldの辛辣な主張24/07/2026
  11. 11リファクタリングをトークン・コストのレバーとして:ファウラーの gen-AI シリーズにおける実験30/07/2026
  12. 12レイチェル・レイコック:「注意力は今や希少な資源となった」 - デブオーケストレーター、8~12のエージェントを並行して管理31/07/2026
  13. 13状況認識が1か月で67%低下:真の信者たちの裁判02/08/2026
  14. 14OpenAI「Astra」が数学とCSの未解決問題10個を解決した可能性 - 証拠を待つ02/08/2026
  15. 15「Cancelling Cursor」: 品質重視で機能の開発速度を抑制02/08/2026
  16. 16ジェフ・ディーンが語るAIチームの間違い:全ての請求書を支払う工房の診断03/08/2026
  17. 17AI需要バブル:実体の支出と人工的な誇大宣伝の分離04/08/2026
  18. 18AIベンチマークは飽和状態にあり、進歩を測る方法が尽きつつある04/08/2026
  19. 19GoogleとAmazonのAI収益がフロンティアケースを際立たせる - フロンティアアクセスが実際の分岐点05/08/2026
  20. 20エージェントAIがガートナージャパンの2026年ハイプサイクルでピーク期待に到達 - シャドーAIこそが真のガバナンスギャップ05/08/2026
  21. 21政府はAIブームに危険な賭けをしている──エコノミストがリスクを指摘06/08/2026
  22. 22Amundi: AIは売り込みにもかかわらず長期的な投資対象であり続ける - 欧州最大の資産運用会社が見るもの06/08/2026
  23. 23パランティアのQ2売上高93%増:実際に出荷されたエンタープライズAIの実態08/08/2026
  24. 24「LLMs Can't Jump」: 大規模言語モデルに根本的な推論の限界があると主張するポジションペーパー08/08/2026
  25. 25理解力はアーキテクチャ上の特性であり、AIが生成したコードはそれが欠けている13/08/2026
  26. 26ソフトウェアのTEMU化:安価で豊富になり、ますます売りにくくなっている14/08/2026
  27. 27オーパス 5の扱いにくさと、モデル評価について14/08/2026
  28. 28Xiaomi 17 Ultraが月を太陽と間違えた - AI写真処理はまだあなたを騙している14/08/2026
  29. 29Anthropicの概念的推論指標は、ベンチマーク汚染問題を対象としている18/08/2026
  30. 30AI取引が日本株のボラティリティを18年ぶりの高水準に押し上げ - 集中リスクが顕在化19/08/2026
  31. 31クリエイター経済のAIとの向き合い方:お金を得ることでオーディエンスを失うとき24/08/2026
  32. 32私はAI盲目になりつつある――そしてそれは現実の問題だ24/08/2026
  33. 33OpenAIの「Astra」モデルが10の未解決数学問題を解決と主張 - AIがベンチマークから脱却し、発見へと転じるとき25/08/2026
Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

Get early access
テーマ
探索
インフォメーション