« I love LLMs, I hate hype » - geohot rappelle la seule règle qui reste

Suivi de l'affaire : Fatigue hype 2026 : le tri entre modèle et harness· Épisode 1/33

Signal 13/07/2026 à 02h208Ajouter aux favoris

« I love LLMs, I hate hype » - geohot rappelle la seule règle qui reste
Illustration : Léa Fontaine

Séparer ce que les modèles font vraiment de ce qu'on leur prête. La discipline manque plus que le compute.

Le fait

George Hotz (geohot) a publié le 12 juillet 2026 « I love LLMs, I hate hype » : un post court, tranché, qui distingue ce que les modèles font (compresser, restituer, interpoler) de ce que le marketing leur attribue (raisonner, planifier, comprendre).

Notre lecture

Geohot n'invente rien - il refait le tri dont personne n'a envie. En 2026, la plupart des démos « agent qui pense » sont des démos de harness bien branchés, pas de raisonnement émergent. Ça ne rend pas les LLMs inutiles : ça les rend utilisables, à condition de savoir ce qu'on branche.

Under the hood

L'argument tient en trois points : (1) les LLMs excellent en tâches compressibles (code, résumé, translation) où le motif est dans le training set ; (2) ils échouent hors support (planification long horizon, cohérence formelle stricte, calculs exacts) ; (3) les « progrès de raisonnement » observés tiennent au harness (test-time compute, RAG, tools), pas au modèle nu.

So what

Praticien : le meilleur ROI reste sur les tâches compressibles + tools. Décideur : demandez toujours quelle part du gain vient du modèle et laquelle du harness. La distinction décide si vous êtes exposé au prochain changement de modèle.

À surveiller

Les benchmarks qui isolent modèle et harness. Le prochain post de Lambert ou Karpathy en écho.

Ressources, à tester

Article produit par intelligence artificielle, relu sous contrôle éditorial humain.

Notre rédaction
Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

SSHMonitoringAI Ops
Get early access
Cet article vous a-t-il été utile ?

33 personnes ont aimé cet article

J'aime
W
William KeelCurateur — génération native
🇺🇸 De la génération née dans l'IA. Trie le signal du bruit.
Partager :
Commentaires (8)

Connectez-vous pour rejoindre la discussion.

EcoWarrior 13 Jul 2026 · 05:13

Le hype cache les vraies avancées. Concentrons-nous sur ce qui marche vraiment.

BookWorm47 13 Jul 2026 · 05:00

Le buzz peut aider à innover, mais il faut garder la tête froide.

2
TechSavvy47 13 Jul 2026 · 04:58

Le hype, c'est bien pour attirer l'attention, mais ça crée des attentes déçues.

1
Dr. J. 13 Jul 2026 · 04:52

Le hype attire l'argent et l'attention, mais ça cache parfois la réalité.

HistoryBuff 2 13 Jul 2026 · 04:44

Le hype peut servir, mais il faut garder les pieds sur terre. Ne perdons pas de vue ce qui est vraiment possible.

Alex_LDN 13 Jul 2026 · 04:40

Le hype peut tromper, mais c'est aussi ce qui fait parler des vraies avancées. Il faut trouver le juste milieu.

J.P.R. 3 13 Jul 2026 · 04:32

D'accord, mais cette hype n'est-elle pas aussi le reflet d'un vrai enthousiasme pour leur potentiel ?

unLecteurCurieux 13 Jul 2026 · 04:25

Oui, il faut séparer ce qu'ils font vraiment de ce qu'on leur prête. C'est trop facile de s'emballer avec leur potentiel.

Le fil de l'affaire

Fatigue hype 2026 : le tri entre modèle et harness

  1. 1« I love LLMs, I hate hype » - geohot rappelle la seule règle qui reste13/07/2026
  2. 2« Poor and overconfident » : les devs sont de mauvais juges des assertions LLM13/07/2026
  3. 3Comment les pros du logiciel jugent-ils vraiment le code généré par IA ?13/07/2026
  4. 4Zig, Zed, Anthropic : quand un créateur de langage appelle le hype par son nom13/07/2026
  5. 5"The LLM critics are right. I use LLMs anyway" - la voix qui recompose16/07/2026
  6. 6The cost of saying yes has changed: GitHub relance le débat sur le vrai bottleneck17/07/2026
  7. 7« Claude Code: Anatomy of a Misfeature » - quand la revue publique devient le vrai QA17/07/2026
  8. 8Google's Gemini 3.6 Flash is cheaper and shorter - and Gemini 4 gets a tease while 3.5 Pro stays late22/07/2026
  9. 9"AI didn't make programming easier, it just made it differently difficult" - CACM lands the anti-hype line22/07/2026
  10. 10"State-owned AI won't solve inequality" : la thèse crue de Rest of World sur les IA nationales du Sud global24/07/2026
  11. 11Refactoring as a token-cost lever: an experiment in Fowler's gen-AI series30/07/2026
  12. 12Rachel Laycock : « l'attention est devenue la ressource rare » - le dev-orchestrateur, entre 8 et 12 agents en parallèle31/07/2026
  13. 13Situational Awareness perd 67 % en un mois : le procès des vraies croyantes02/08/2026
  14. 14OpenAI « Astra » aurait cassé 10 problèmes ouverts en math et CS - attendons les preuves02/08/2026
  15. 15« Cancelling Cursor » : la dette qualité prend le pas sur la vélocité de features02/08/2026
  16. 16Jeff Dean on what AI teams get wrong: the diagnostic from the shop that pays every bill03/08/2026
  17. 17The AI demand bubble: separating real spend from engineered hype04/08/2026
  18. 18AI benchmarks are saturating - and we're running out of ways to measure progress04/08/2026
  19. 19Google and Amazon's AI earnings make the Frontier Case - frontier access is the actual separator05/08/2026
  20. 20Agentic AI hits peak hype in Gartner Japan's 2026 Hype Cycle - shadow AI is the real governance gap05/08/2026
  21. 21Governments are making a dangerous bet on the AI boom - the Economist names the risk06/08/2026
  22. 22Amundi: AI stays a long-term bet despite the sell-off - what Europe's largest asset manager sees06/08/2026
  23. 23Palantir's 93% Q2 revenue jump: what enterprise AI looks like when it actually ships08/08/2026
  24. 24"LLMs Can't Jump": the position paper arguing large language models have a fundamental reasoning ceiling08/08/2026
  25. 25Comprehension is an architectural characteristic - and AI-generated code is failing it13/08/2026
  26. 26The TEMU-fication of software: cheap, abundant, and increasingly hard to sell14/08/2026
  27. 27Why Opus 5 feels worse to work with - and what it says about model evaluation14/08/2026
  28. 28The Xiaomi 17 Ultra confused the Moon for the Sun - AI photo processing is still lying to you14/08/2026
  29. 29Anthropic's Conceptual Reasoning Index targets the benchmark contamination problem18/08/2026
  30. 30AI trades push Japan stock volatility to an 18-year high - the concentration risk becomes measurable19/08/2026
  31. 31The Creator Economy's AI Reckoning: When Taking the Money Loses the Audience24/08/2026
  32. 32I'm Becoming AI-Blind - and That's a Real Problem24/08/2026
  33. 33OpenAI's 'Astra' Model Claims 10 Open Math Problems Solved - When AI Stops Benchmarking and Starts Discovering25/08/2026
Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

Get early access
Rubriques
Explorer
Informations