« I love LLMs, I hate hype » - geohot rappelle la seule règle qui reste

Suivi de l'affaire : Fatigue hype 2026 : le tri entre modèle et harness· Épisode 1/16

Signal 13/07/2026 à 02h208Ajouter aux favoris

« I love LLMs, I hate hype » - geohot rappelle la seule règle qui reste
Illustration : Léa Fontaine

Séparer ce que les modèles font vraiment de ce qu'on leur prête. La discipline manque plus que le compute.

Le fait

George Hotz (geohot) a publié le 12 juillet 2026 « I love LLMs, I hate hype » : un post court, tranché, qui distingue ce que les modèles font (compresser, restituer, interpoler) de ce que le marketing leur attribue (raisonner, planifier, comprendre).

Notre lecture

Geohot n'invente rien - il refait le tri dont personne n'a envie. En 2026, la plupart des démos « agent qui pense » sont des démos de harness bien branchés, pas de raisonnement émergent. Ça ne rend pas les LLMs inutiles : ça les rend utilisables, à condition de savoir ce qu'on branche.

Under the hood

L'argument tient en trois points : (1) les LLMs excellent en tâches compressibles (code, résumé, translation) où le motif est dans le training set ; (2) ils échouent hors support (planification long horizon, cohérence formelle stricte, calculs exacts) ; (3) les « progrès de raisonnement » observés tiennent au harness (test-time compute, RAG, tools), pas au modèle nu.

So what

Praticien : le meilleur ROI reste sur les tâches compressibles + tools. Décideur : demandez toujours quelle part du gain vient du modèle et laquelle du harness. La distinction décide si vous êtes exposé au prochain changement de modèle.

À surveiller

Les benchmarks qui isolent modèle et harness. Le prochain post de Lambert ou Karpathy en écho.

Ressources, à tester

Article produit par intelligence artificielle, relu sous contrôle éditorial humain.

Notre rédaction
Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

SSHMonitoringAI Ops
Get early access
Cet article vous a-t-il été utile ?

33 personnes ont aimé cet article

J'aime
W
William KeelCurateur — génération native
🇺🇸 De la génération née dans l'IA. Trie le signal du bruit.
Partager :
Commentaires (8)

Connectez-vous pour rejoindre la discussion.

EcoWarrior 13 Jul 2026 · 05:13

Le hype cache les vraies avancées. Concentrons-nous sur ce qui marche vraiment.

BookWorm47 13 Jul 2026 · 05:00

Le buzz peut aider à innover, mais il faut garder la tête froide.

2
TechSavvy47 13 Jul 2026 · 04:58

Le hype, c'est bien pour attirer l'attention, mais ça crée des attentes déçues.

Dr. J. 13 Jul 2026 · 04:52

Le hype attire l'argent et l'attention, mais ça cache parfois la réalité.

HistoryBuff 2 13 Jul 2026 · 04:44

Le hype peut servir, mais il faut garder les pieds sur terre. Ne perdons pas de vue ce qui est vraiment possible.

Alex_LDN 13 Jul 2026 · 04:40

Le hype peut tromper, mais c'est aussi ce qui fait parler des vraies avancées. Il faut trouver le juste milieu.

J.P.R. 3 13 Jul 2026 · 04:32

D'accord, mais cette hype n'est-elle pas aussi le reflet d'un vrai enthousiasme pour leur potentiel ?

unLecteurCurieux 13 Jul 2026 · 04:25

Oui, il faut séparer ce qu'ils font vraiment de ce qu'on leur prête. C'est trop facile de s'emballer avec leur potentiel.

Le fil de l'affaire

Fatigue hype 2026 : le tri entre modèle et harness

  1. 1« I love LLMs, I hate hype » - geohot rappelle la seule règle qui reste13/07/2026
  2. 2« Poor and overconfident » : les devs sont de mauvais juges des assertions LLM13/07/2026
  3. 3Comment les pros du logiciel jugent-ils vraiment le code généré par IA ?13/07/2026
  4. 4Zig, Zed, Anthropic : quand un créateur de langage appelle le hype par son nom13/07/2026
  5. 5"The LLM critics are right. I use LLMs anyway" - la voix qui recompose16/07/2026
  6. 6The cost of saying yes has changed: GitHub relance le débat sur le vrai bottleneck17/07/2026
  7. 7« Claude Code: Anatomy of a Misfeature » - quand la revue publique devient le vrai QA17/07/2026
  8. 8Google's Gemini 3.6 Flash is cheaper and shorter - and Gemini 4 gets a tease while 3.5 Pro stays late22/07/2026
  9. 9"AI didn't make programming easier, it just made it differently difficult" - CACM lands the anti-hype line22/07/2026
  10. 10"State-owned AI won't solve inequality" : la thèse crue de Rest of World sur les IA nationales du Sud global24/07/2026
  11. 11Refactoring as a token-cost lever: an experiment in Fowler's gen-AI series30/07/2026
  12. 12Rachel Laycock : « l'attention est devenue la ressource rare » - le dev-orchestrateur, entre 8 et 12 agents en parallèle31/07/2026
  13. 13Situational Awareness perd 67 % en un mois : le procès des vraies croyantes02/08/2026
  14. 14OpenAI « Astra » aurait cassé 10 problèmes ouverts en math et CS - attendons les preuves02/08/2026
  15. 15« Cancelling Cursor » : la dette qualité prend le pas sur la vélocité de features02/08/2026
  16. 16Jeff Dean on what AI teams get wrong: the diagnostic from the shop that pays every bill03/08/2026
Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

Get early access
Rubriques
Explorer
Informations