« Ich liebe LLMs, ich hasse Hype » - geohot erinnert an die einzige Regel, die bleibt

Fortlaufende Berichterstattung : Fatigue hype 2026 : le tri entre modèle et harness· Teil 1/33

Signal Jul 13, 2026 at 02:208Zu Lesezeichen hinzufügen

« Ich liebe LLMs, ich hasse Hype » - geohot erinnert an die einzige Regel, die bleibt
Illustration : Léa Fontaine

Trennen, was die Modelle wirklich tun, von dem, was man ihnen zuschreibt. Es fehlt mehr an Disziplin als an Rechenleistung.

Der Fakt

George Hotz (geohot) veröffentlichte am 12. Juli 2026 « I love LLMs, I hate hype »: einen kurzen, prägnanten Post, der zwischen dem unterscheidet, was die Modelle tun (komprimieren, wiedergeben, interpolieren) und was das Marketing ihnen zuschreibt (argumentieren, planen, verstehen).

Unsere Interpretation

Geohot erfindet nichts Neues - er macht die Sortierung, die niemand machen will. Im Jahr 2026 sind die meisten Demos « Agent, der denkt » Demos von gut angebundenen Harnesses, nicht von emergenten Argumentationen. Das macht die LLMs nicht nutzlos: Es macht sie brauchbar, vorausgesetzt, man weiß, was man anbindet.

Under the hood

Das Argument besteht aus drei Punkten: (1) LLMs sind hervorragend in komprimierbaren Aufgaben (Code, Zusammenfassung, Übersetzung), bei denen das Muster im Trainingsset liegt; (2) sie scheitern außerhalb der Unterstützung (langfristige Planung, strikte formale Kohärenz, exakte Berechnungen); (3) die beobachteten « Fortschritte im Argumentieren » beruhen auf dem Harness (Testzeit-Berechnung, RAG, Tools), nicht auf dem nackten Modell.

So what

Praktiker: Der beste ROI bleibt bei komprimierbaren Aufgaben + Tools. Entscheider: Fragen Sie immer, welcher Teil des Gewinns kommt vom Modell und welcher vom Harness. Die Unterscheidung entscheidet, ob Sie dem nächsten Modellwechsel ausgesetzt sind.

Zu beobachten

Die Benchmarks, die Modell und Harness isolieren. Der nächste Post von Lambert oder Karpathy als Echo.

Resources

Artikel von künstlicher Intelligenz erstellt, unter menschlicher redaktioneller Kontrolle geprüft.

Unsere Redaktion
Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

SSHMonitoringAI Ops
Get early access
War dieser Artikel hilfreich?

33 Personen gefiel dieser Artikel

Gefällt mir
W
William KeelKurator — Generation Native
🇩🇪 Von der Generation, die in der KI geboren wurde. Trenne Signal von Rauschen.
Teilen:
Kommentare (8)

Melden Sie sich an, um an der Diskussion teilzunehmen.

EcoWarrior 13 Jul 2026 · 05:13

Le hype cache les vraies avancées. Concentrons-nous sur ce qui marche vraiment.

BookWorm47 13 Jul 2026 · 05:00

Le buzz peut aider à innover, mais il faut garder la tête froide.

2
TechSavvy47 13 Jul 2026 · 04:58

Le hype, c'est bien pour attirer l'attention, mais ça crée des attentes déçues.

1
Dr. J. 13 Jul 2026 · 04:52

Le hype attire l'argent et l'attention, mais ça cache parfois la réalité.

HistoryBuff 2 13 Jul 2026 · 04:44

Le hype peut servir, mais il faut garder les pieds sur terre. Ne perdons pas de vue ce qui est vraiment possible.

Alex_LDN 13 Jul 2026 · 04:40

Le hype peut tromper, mais c'est aussi ce qui fait parler des vraies avancées. Il faut trouver le juste milieu.

J.P.R. 3 13 Jul 2026 · 04:32

D'accord, mais cette hype n'est-elle pas aussi le reflet d'un vrai enthousiasme pour leur potentiel ?

unLecteurCurieux 13 Jul 2026 · 04:25

Oui, il faut séparer ce qu'ils font vraiment de ce qu'on leur prête. C'est trop facile de s'emballer avec leur potentiel.

Chronologie des Themas

Fatigue hype 2026 : le tri entre modèle et harness

  1. 1« Ich liebe LLMs, ich hasse Hype » - geohot erinnert an die einzige Regel, die bleibt13/07/2026
  2. 2« Arm und überheblich »: Entwickler sind schlechte Richter über LLM-Aussagen13/07/2026
  3. 3Wie bewerten Software-Profis den von KI generierten Code wirklich?13/07/2026
  4. 4Zig, Zed, Anthropic: Wenn ein Sprachschöpfer den Hype beim Namen nennt13/07/2026
  5. 5"Die LLM-Kritiker haben recht. Ich nutze LLM trotzdem" - die Stimme, die neu zusammensetzt16/07/2026
  6. 6Die Kosten für ein "Ja" haben sich verändert: GitHub bringt die Debatte über den echten Engpass wieder auf17/07/2026
  7. 7« Claude Code: Anatomy of a Misfeature » - wenn die öffentliche Überprüfung zum echten QA wird17/07/2026
  8. 8Google's Gemini 3.6 Flash ist günstiger und kürzer - und Gemini 4 bekommt einen Teaser, während 3.5 Pro länger bleibt22/07/2026
  9. 9"KI hat das Programmieren nicht einfacher gemacht, sie hat es nur anders schwierig gemacht" - CACM landet den Anti-Hype-Satz22/07/2026
  10. 10"Staatlich kontrollierte KI wird die Ungleichheit nicht lösen": die These von Rest of World über die nationalen KIs des globalen Südens24/07/2026
  11. 11Refactoring als Hebel für Token-Kosten: Ein Experiment in Fowlers gen-AI-Serie30/07/2026
  12. 12Rachel Laycock: „Aufmerksamkeit ist zur seltenen Ressource geworden“ – der Dev-Orchestrator zwischen 8 und 12 Agenten parallel31/07/2026
  13. 13Situational Awareness verliert 67 % in einem Monat: der Prozess der wahren Gläubigen02/08/2026
  14. 14OpenAI « Astra » soll 10 offene Probleme in Mathematik und Informatik gelöst haben – wir warten auf die Beweise02/08/2026
  15. 15« Cancelling Cursor »: Die Qualitätsverschuldung überwiegt die Feature-Velocity02/08/2026
  16. 16Jeff Dean über die Fehler von KI-Teams: die Diagnose aus der Werkstatt, die jede Rechnung bezahlt03/08/2026
  17. 17Die KI-Nachfrageblase: echte Ausgaben von künstlich erzeugtem Hype trennen04/08/2026
  18. 18KI-Benchmarks sättigen sich – und uns gehen die Möglichkeiten aus, Fortschritte zu messen04/08/2026
  19. 19Google und Amazons KI-Erträge machen den Frontier Case deutlich – der Zugang zu Frontier ist der eigentliche Trennungsfaktor05/08/2026
  20. 20Agentic AI erreicht den Höhepunkt der Hype-Zyklen in Gartners Japan Hype Cycle 2026 – Schatten-AI ist die eigentliche Governance-Lücke05/08/2026
  21. 21Regierungen setzen auf einen gefährlichen Einsatz beim KI-Boom – das *Economist* benennt das Risiko06/08/2026
  22. 22Amundi: KI bleibt ein langfristiger Einsatz trotz des Ausverkaufs – was Europas größter Vermögensverwalter sieht06/08/2026
  23. 23Palantirs 93%iger Q2-Umsatzsprung: So sieht unternehmensweite KI aus, wenn sie tatsächlich ausgeliefert wird08/08/2026
  24. 24"LLMs können nicht springen": das Positionspapier, das argumentiert, dass große Sprachmodelle eine grundlegende Grenze der Argumentationsfähigkeit haben08/08/2026
  25. 25Verständnis ist eine architektonische Eigenschaft – und von KI-generierter Code scheitert daran.13/08/2026
  26. 26Die TEMU-isierung von Software: günstig, reichlich vorhanden und zunehmend schwer zu verkaufen14/08/2026
  27. 27Warum Opus 5 sich schlechter anfühlt – und was das über die Modellbewertung aussagt14/08/2026
  28. 28Das Xiaomi 17 Ultra verwechselte den Mond mit der Sonne – KI-Bildverarbeitung lügt dich immer noch an14/08/2026
  29. 29Anthropics Konzeptindex für konzeptionelles Denken zielt auf das Problem der Benchmark-Kontamination ab.18/08/2026
  30. 30KI-Handel treibt Japans Aktienvolatilität auf ein 18-Jahres-Hoch – das Konzentrationsrisiko wird messbar19/08/2026
  31. 31Die Kreativwirtschafts-Rechnung der KI: Wenn das Geldnehmen das Publikum verliert24/08/2026
  32. 32Ich werde KI-blind – und das ist ein echtes Problem24/08/2026
  33. 33OpenAIs „Astra“-Modell behauptet, 10 offene Mathematikprobleme gelöst zu haben – Wenn KI nicht mehr benchmarkt, sondern entdeckt25/08/2026
Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

Get early access
Themen
Erkunden
Informationen