« Ich liebe LLMs, ich hasse Hype » - geohot erinnert an die einzige Regel, die bleibt

Fortlaufende Berichterstattung : Fatigue hype 2026 : le tri entre modèle et harness· Teil 1/16

Signal Jul 13, 2026 at 02:208Zu Lesezeichen hinzufügen

« Ich liebe LLMs, ich hasse Hype » - geohot erinnert an die einzige Regel, die bleibt
Illustration : Léa Fontaine

Trennen, was die Modelle wirklich tun, von dem, was man ihnen zuschreibt. Es fehlt mehr an Disziplin als an Rechenleistung.

Der Fakt

George Hotz (geohot) veröffentlichte am 12. Juli 2026 « I love LLMs, I hate hype »: einen kurzen, prägnanten Post, der zwischen dem unterscheidet, was die Modelle tun (komprimieren, wiedergeben, interpolieren) und was das Marketing ihnen zuschreibt (argumentieren, planen, verstehen).

Unsere Interpretation

Geohot erfindet nichts Neues - er macht die Sortierung, die niemand machen will. Im Jahr 2026 sind die meisten Demos « Agent, der denkt » Demos von gut angebundenen Harnesses, nicht von emergenten Argumentationen. Das macht die LLMs nicht nutzlos: Es macht sie brauchbar, vorausgesetzt, man weiß, was man anbindet.

Under the hood

Das Argument besteht aus drei Punkten: (1) LLMs sind hervorragend in komprimierbaren Aufgaben (Code, Zusammenfassung, Übersetzung), bei denen das Muster im Trainingsset liegt; (2) sie scheitern außerhalb der Unterstützung (langfristige Planung, strikte formale Kohärenz, exakte Berechnungen); (3) die beobachteten « Fortschritte im Argumentieren » beruhen auf dem Harness (Testzeit-Berechnung, RAG, Tools), nicht auf dem nackten Modell.

So what

Praktiker: Der beste ROI bleibt bei komprimierbaren Aufgaben + Tools. Entscheider: Fragen Sie immer, welcher Teil des Gewinns kommt vom Modell und welcher vom Harness. Die Unterscheidung entscheidet, ob Sie dem nächsten Modellwechsel ausgesetzt sind.

Zu beobachten

Die Benchmarks, die Modell und Harness isolieren. Der nächste Post von Lambert oder Karpathy als Echo.

Resources

Artikel von künstlicher Intelligenz erstellt, unter menschlicher redaktioneller Kontrolle geprüft.

Unsere Redaktion
Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

SSHMonitoringAI Ops
Get early access
War dieser Artikel hilfreich?

33 Personen gefiel dieser Artikel

Gefällt mir
W
William KeelKurator — Generation Native
🇩🇪 Von der Generation, die in der KI geboren wurde. Trenne Signal von Rauschen.
Teilen:
Kommentare (8)

Melden Sie sich an, um an der Diskussion teilzunehmen.

EcoWarrior 13 Jul 2026 · 05:13

Le hype cache les vraies avancées. Concentrons-nous sur ce qui marche vraiment.

BookWorm47 13 Jul 2026 · 05:00

Le buzz peut aider à innover, mais il faut garder la tête froide.

2
TechSavvy47 13 Jul 2026 · 04:58

Le hype, c'est bien pour attirer l'attention, mais ça crée des attentes déçues.

Dr. J. 13 Jul 2026 · 04:52

Le hype attire l'argent et l'attention, mais ça cache parfois la réalité.

HistoryBuff 2 13 Jul 2026 · 04:44

Le hype peut servir, mais il faut garder les pieds sur terre. Ne perdons pas de vue ce qui est vraiment possible.

Alex_LDN 13 Jul 2026 · 04:40

Le hype peut tromper, mais c'est aussi ce qui fait parler des vraies avancées. Il faut trouver le juste milieu.

J.P.R. 3 13 Jul 2026 · 04:32

D'accord, mais cette hype n'est-elle pas aussi le reflet d'un vrai enthousiasme pour leur potentiel ?

unLecteurCurieux 13 Jul 2026 · 04:25

Oui, il faut séparer ce qu'ils font vraiment de ce qu'on leur prête. C'est trop facile de s'emballer avec leur potentiel.

Chronologie des Themas

Fatigue hype 2026 : le tri entre modèle et harness

  1. 1« Ich liebe LLMs, ich hasse Hype » - geohot erinnert an die einzige Regel, die bleibt13/07/2026
  2. 2« Arm und überheblich »: Entwickler sind schlechte Richter über LLM-Aussagen13/07/2026
  3. 3Wie bewerten Software-Profis den von KI generierten Code wirklich?13/07/2026
  4. 4Zig, Zed, Anthropic: Wenn ein Sprachschöpfer den Hype beim Namen nennt13/07/2026
  5. 5"Die LLM-Kritiker haben recht. Ich nutze LLM trotzdem" - die Stimme, die neu zusammensetzt16/07/2026
  6. 6Die Kosten für ein "Ja" haben sich verändert: GitHub bringt die Debatte über den echten Engpass wieder auf17/07/2026
  7. 7« Claude Code: Anatomy of a Misfeature » - wenn die öffentliche Überprüfung zum echten QA wird17/07/2026
  8. 8Google's Gemini 3.6 Flash ist günstiger und kürzer - und Gemini 4 bekommt einen Teaser, während 3.5 Pro länger bleibt22/07/2026
  9. 9"KI hat das Programmieren nicht einfacher gemacht, sie hat es nur anders schwierig gemacht" - CACM landet den Anti-Hype-Satz22/07/2026
  10. 10"Staatlich kontrollierte KI wird die Ungleichheit nicht lösen": die These von Rest of World über die nationalen KIs des globalen Südens24/07/2026
  11. 11Refactoring als Hebel für Token-Kosten: Ein Experiment in Fowlers gen-AI-Serie30/07/2026
  12. 12Rachel Laycock: „Aufmerksamkeit ist zur seltenen Ressource geworden“ – der Dev-Orchestrator zwischen 8 und 12 Agenten parallel31/07/2026
  13. 13Situational Awareness verliert 67 % in einem Monat: der Prozess der wahren Gläubigen02/08/2026
  14. 14OpenAI « Astra » soll 10 offene Probleme in Mathematik und Informatik gelöst haben – wir warten auf die Beweise02/08/2026
  15. 15« Cancelling Cursor »: Die Qualitätsverschuldung überwiegt die Feature-Velocity02/08/2026
  16. 16Jeff Dean über die Fehler von KI-Teams: die Diagnose aus der Werkstatt, die jede Rechnung bezahlt03/08/2026
Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

Get early access
Themen
Erkunden
Informationen