Google의 Gemini 3.6 Flash는 더 저렴하고 짧아졌으며, Gemini 4는 teas를 받지만 3.5 Pro는 늦게 유지됩니다.

진행 중인 이슈 : Fatigue hype 2026 : le tri entre modèle et harness· 편 8/33

모델 및 도구 Jul 22, 2026 at 12:417북마크에 추가

Google의 Gemini 3.6 Flash는 더 저렴하고 짧아졌으며, Gemini 4는 teas를 받지만 3.5 Pro는 늦게 유지됩니다.
삽화 : Léa Fontaine

구글이Gemini 4를 대기실에서 테스트하고 Gemini 3.5 Pro는 출발선에 그대로 둔 가운데, '출력 토큰 감소, 비용 절감'에 중점을 둔 세 가지 새로운 Gemini 모델을 발표했다.

간단히 말해

Google은 2026년 7월 21일 Gemini 3.6 Flash를 비롯한 세 가지 새로운 Gemini 모델을 출시했습니다. 핵심은 간단합니다: 출력 토큰 감소, 저렴한 가격, 그리고 사이버보안 최적화 모델이 포함되었습니다. 그러나Gemini 3.5 Pro(수주간 홍보된 플래그십 추론 모델)는 아직 테스트 중입니다. Google은 대신 Gemini 4를 사전 발표했습니다.

배경

Google의 2026년 Gemini 출시 주기는 순탄치 않았습니다: 3.5 Pro는 여러 번 연기되었으며, Google은 내부적으로 코딩 벤치마크 성능 저하를 이유로 들었습니다. '준비된 것 먼저 출시하기'(Flash 및 인접한 специализирован 모델) 접근 방식은 플래그십 추론 모델을 재정비하는 동안 릴리스 주기를 유지하기 위한 방법입니다.

보고된 데이터

  • 세 가지 모델 발표: Gemini 3.6 Flash(일반 목적, 더 빠름), 사이버보안 전용 모델, 그리고 세 번째 공개 미리보기용 미공개 모델.
  • Google은 3.5 Flash 대비 동등한 작업에서 출력 토큰이 감소했다고 주장하며, 이는 요청당 비용 절감으로 이어집니다. 정확한 벤치마크 차이는 출시 포스트에서 공개되지 않았습니다.
  • Gemini 3.5 Pro는 아직 테스트 중임을 확인했습니다.
  • Gemini 4가 teas됨 - 출시일, 성능 사양, 가격 미공개.

분석

두 가지 일이 동시에 일어나고 있습니다. 첫째, Google은 비용과 지연 시간을 최적화한 Flash급 모델과 가장 어려운 추론을 위한 Pro/Ultra급 모델로 이원화된 모델 구도를 확정했습니다. 이는 OpenAI의 GPT-5.6 vs Codex/Work 분리와 Anthropic의 Fable vs Haiku 분리와 유사합니다. 세 Frontier 연구실이 동일한 제품 구도를 향해 수렴하고 있습니다.

둘째, 3.5 Pro가 출시되지 않은 상태에서 Gemini 4를 teas하는 것은 신호일 뿐, 유출은 아닙니다. Google이 시장에 그리고 기업 구매자에게 전달하는 메시지는 "더 발전할 여지가 있다"는 것이며, 경쟁사들에 밀리지 않겠다는 것입니다. 핵심은 "더coming soon"이라는 메시지만으로도 플래그십 모델이 늦어질 때 파이프라인을 유지할 수 있다는 것입니다.

구매자 입장의 엔지니어: 3.6 Flash의 실질 가치는 측정 가능합니다 - 출력 토큰 감소는 프로덕션에서 누적됩니다. 가장 지연 시간이 긴 작업에 대해 테스트해 보세요. CFO와의 로드맵 논의: 3.5 Pro가 실제로 GA(일반 출시)될 때까지 다년 계약에 서명하지 마세요.

시나리오

  • 기본 시나리오 (55%): Gemini 3.5 Pro가 60일 이내에 출시되며, 추론 성능은 Fable 5와 비슷하거나 약간 우위; Gemini 4는 2027년 1분기 출시.
  • 지연 시나리오 (30%): 3.5 Pro가 다시 연기됨; Google은 Flash tier에 더 의존하며, Anthropic과 OpenAI가 추론 리드 연장.
  • 도약 시나리오 (15%): Google이 3.5 Pro를 건너뛰고 4로 바로 도약 - "Windows 9"식 전략.

시사점

개발자: 기다리지 마세요 - 3.6 Flash는 지금 벤치마크할 가치가 있습니다. 의사결정자: 이원화된 모델 구도가 현실화되었습니다. 이름만 대고 싶은 플래그십이 아니라 실제로 필요한 tier를 구매하세요.

Resources

인공지능이 작성하고 사람의 편집 감독하에 검수한 기사입니다.

편집팀
Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

SSHMonitoringAI Ops
Get early access
이 기사가 도움이 되었나요?

16 명이 이 기사를 좋아합니다

좋아요
P
Priya RamanMachine Learning Engineer
🇬🇧 ML engineer, applied research.
공유:
댓글 (7)

토론에 참여하려면 로그인하세요.

HistoryBuff 22 Jul 2026 · 09:21

I hope Gemini 3.6 Flash will handle creative tasks well. Shorter outputs might limit artistic expression.

sandrine.b 22 Jul 2026 · 09:14

I wonder if Gemini 3.6 Flash will be suitable for detailed, nuanced discussions. Shorter outputs might not capture the depth needed for complex topics.

ArtLover99 22 Jul 2026 · 08:52

I'm interested in seeing how Gemini 4 will compare to the Flash and Pro models. Will it offer a balanced mix of cost and quality?

J.P.R. 2 22 Jul 2026 · 11:11

Gemini 4 might focus on advanced features rather than cost, setting it apart from Flash and Pro.

J.P.R. 22 Jul 2026 · 08:47

I'm concerned about the potential lack of depth in Gemini 3.6 Flash. Will it sacrifice quality for brevity?

CriticAtHeart 22 Jul 2026 · 08:44

I wonder how the shorter outputs will impact complex queries. Will Gemini 3.6 Flash still deliver the depth needed for detailed analysis?

Emma_London 22 Jul 2026 · 08:05

I'm curious about the balance between cost and quality in these new models. Will the shorter outputs still provide meaningful insights?

Dr. J. 22 Jul 2026 · 07:58

Google's new Gemini models sound promising, but I wonder how the reduced token output will affect the quality of responses.

이슈 타임라인

Fatigue hype 2026 : le tri entre modèle et harness

  1. 1**« LLMs를 사랑하지만, 과장된 선전은 싫어합니다」 - geohot, 남아 있는 유일한 규칙을 상기시키다**13/07/2026
  2. 2« Poor and overconfident »: 개발자들은 LLM의 주장에 대한 나쁜 판관13/07/2026
  3. 3어떻게 소프트웨어 전문가들은 AI가 생성한 코드를 정말 평가할까요?13/07/2026
  4. 4지그, 제드, 앤트로픽: 한 프로그래밍 언어 창시자가 과장된 광고를 이름 짓다13/07/2026
  5. 5LLM 비판론자들은 옳다. 그래도 나는 LLMs를 사용한다 - 재구성된 목소리16/07/2026
  6. 6GitHub가 "예스"라고 말하는 비용이 변했습니다: GitHub가 진정한 병목 현상에 대한 논쟁을 재점화합니다17/07/2026
  7. 7« Claude Code: 해로운 기능의 해부 » - 공개 리뷰가 진정한 QA가 되는 순간17/07/2026
  8. 8Google의 Gemini 3.6 Flash는 더 저렴하고 짧아졌으며, Gemini 4는 teas를 받지만 3.5 Pro는 늦게 유지됩니다.22/07/2026
  9. 9AI가 프로그래밍을 더 쉽게 만들지 않았으며, 단지 다르게 어렵게 만들었을 뿐입니다 - CACM이 반하이프 라인을 제시합니다.22/07/2026
  10. 10국가 소유 AI가 불평등을 해결하지 못할 것이라는 레스트 오브 월드의 냉정한 thesis24/07/2026
  11. 11리팩토링을 토큰 비용 레버로: 파울러의 Gen-AI 시리즈 실험30/07/2026
  12. 12레이첼 레이콕 : “‘주의’가 희귀한 자원이 되었습니다” - 8~12명의 에이전트를 동시에 관리하는 개발 오케스트레이터31/07/2026
  13. 13상황 인식 능력 67% 감소: 진정한 신자들의 재판02/08/2026
  14. 14OpenAI « Astra »가 수학 및 CS 분야에서 해결되지 않은 10개 문제를 해결했다는 주장 - 증거를 기다려야 할 듯02/08/2026
  15. 15"Cancelling Cursor": 품질에 대한 부채가 기능의 속도를 앞지르다02/08/2026
  16. 16제프 딘이 말하는 AI 팀의 잘못된 점: 모든 비용을 지불하는 상점에서 진단을 내리며03/08/2026
  17. 17AI 수요 버블: 실제 지출과 조작된 과장 구분하기04/08/2026
  18. 18AI 벤치마크는 포화 상태에 이르렀고, 우리는 진보를 측정할 새로운 방법을 찾고 있다.04/08/2026
  19. 19구글과 아마존의 AI 수익이 프론티어 케이스를 만든다 - 프론티어 접근이 실제 차별화 요소다05/08/2026
  20. 20에이전트 AI가 가트너 재팬의 2026 하이프 사이클에서 최고 조명을 받다 - 섀도 AI가 진정한 거버넌스 격차다05/08/2026
  21. 21정부가 AI 붐에 위험한 베팅을 하고 있다 - 이코노미스트가 위험을 지적하다06/08/2026
  22. 22아몬디: AI는 매도 사태에도 불구하고 장기 베팅으로 남아있다 - 유럽 최대 자산운용사가 보는 시선06/08/2026
  23. 23팔란티어의 2분기 93% 매출 급등: 실제로 배포된 엔터프라이즈 AI의 모습08/08/2026
  24. 24"LLMs는 뛰어오를 수 없다": 대규모 언어 모델이 근본적인 추론 한계를 지닌다는 입장 논문08/08/2026
  25. 25이해력은 아키텍처적 특성입니다. 그리고 AI가 생성한 코드는 이 특성을 갖추지 못하고 있습니다.13/08/2026
  26. 26소프트웨어의 TEMU화: 값싸고 풍부해지며 점점 팔기 어려워지는 현상14/08/2026
  27. 27Opus 5를 작업하기에 더 나쁜 느낌이 드는 이유 - 그리고 모델 평가가 시사하는 바14/08/2026
  28. 28Xiaomi 17 Ultra가 달을 태양으로 착각하다 - AI 사진 처리 기술이 여전히 당신을 속이고 있다14/08/2026
  29. 29앤트로픽의 개념적 추론 지수는 벤치마크 오염 문제를 겨냥합니다.18/08/2026
  30. 30AI 거래가 일본 주식 변동성을 18년 만에 최고 수준으로 끌어올렸다 - 집중 위험이 가시화되고 있다19/08/2026
  31. 31크리에이터 경제의 AI 숙명: 돈을 벌 때 관중을 잃는 순간24/08/2026
  32. 32저는 AI-盲人(盲人)이 되어가고 있습니다. 그리고 그것은 정말 큰 문제입니다.24/08/2026
  33. 33OpenAI의 'Astra' 모델, 10개의 공개 수학 문제 해결 주장 - AI가 벤치마킹을 멈추고 발견하기 시작할 때25/08/2026
Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

Get early access
토픽
탐색
정보