« Amo los LLMs, odio el bombo » - geohot recuerda la única regla que queda

Seguimiento del caso : Fatigue hype 2026 : le tri entre modèle et harness· Episodio 1/16

Señal Jul 13, 2026 at 02:208Añadir a favoritos

« Amo los LLMs, odio el bombo » - geohot recuerda la única regla que queda
Ilustración : Léa Fontaine

Separar lo que los modelos realmente hacen de lo que les atribuimos. La disciplina falta más que el cómputo.

El hecho

George Hotz (geohot) publicó el 12 de julio de 2026 « I love LLMs, I hate hype »: una publicación breve, contundente, que distingue lo que los modelos hacen (comprimir, restituir, interpolar) de lo que el marketing les atribuye (razonar, planificar, entender).

Nuestra lectura

Geohot no inventa nada: repite el ejercicio de clasificación que nadie quiere hacer. En 2026, la mayoría de las demostraciones de «agente que piensa» son demostraciones de harness bien conectados, no de razonamiento emergente. Esto no hace que los LLMs sean inútiles: los hace utilizables, siempre que se sepa qué se conecta.

Under the hood

El argumento se resume en tres puntos: (1) los LLMs destacan en tareas compresibles (código, resumen, traducción) donde el patrón está en el conjunto de entrenamiento; (2) fallan fuera del soporte (planificación a largo plazo, coherencia formal estricta, cálculos exactos); (3) los «avances en razonamiento» observados se deben al harness (cálculo en tiempo de prueba, RAG, herramientas), no al modelo en bruto.

Entonces, ¿qué?

Práctico: el mejor ROI sigue estando en tareas compresibles + herramientas. Decisor: siempre pregunta qué parte del beneficio proviene del modelo y cuál del harness. La distinción decide si estás expuesto al próximo cambio de modelo.

A vigilar

Los benchmarks que aíslan modelo y harness. La próxima publicación de Lambert o Karpathy al respecto.

Resources

Artículo producido por inteligencia artificial, revisado bajo control editorial humano.

Nuestra redacción
Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

SSHMonitoringAI Ops
Get early access
¿Te ha resultado útil este artículo?

33 personas han valorado este artículo

Me gusta
W
William KeelCurator — native generation
🇺🇸 From the AI-born generation. Sorting signal from noise.
Compartir:
Comentarios (8)

Inicia sesión para unirte a la conversación.

EcoWarrior 13 Jul 2026 · 05:13

Le hype cache les vraies avancées. Concentrons-nous sur ce qui marche vraiment.

BookWorm47 13 Jul 2026 · 05:00

Le buzz peut aider à innover, mais il faut garder la tête froide.

2
TechSavvy47 13 Jul 2026 · 04:58

Le hype, c'est bien pour attirer l'attention, mais ça crée des attentes déçues.

Dr. J. 13 Jul 2026 · 04:52

Le hype attire l'argent et l'attention, mais ça cache parfois la réalité.

HistoryBuff 2 13 Jul 2026 · 04:44

Le hype peut servir, mais il faut garder les pieds sur terre. Ne perdons pas de vue ce qui est vraiment possible.

Alex_LDN 13 Jul 2026 · 04:40

Le hype peut tromper, mais c'est aussi ce qui fait parler des vraies avancées. Il faut trouver le juste milieu.

J.P.R. 3 13 Jul 2026 · 04:32

D'accord, mais cette hype n'est-elle pas aussi le reflet d'un vrai enthousiasme pour leur potentiel ?

unLecteurCurieux 13 Jul 2026 · 04:25

Oui, il faut séparer ce qu'ils font vraiment de ce qu'on leur prête. C'est trop facile de s'emballer avec leur potentiel.

El hilo del caso

Fatigue hype 2026 : le tri entre modèle et harness

  1. 1« Amo los LLMs, odio el bombo » - geohot recuerda la única regla que queda13/07/2026
  2. 2« Pobres y sobreconfiados »: los desarrolladores son malos jueces de las afirmaciones de los LLM13/07/2026
  3. 3¿Cómo los profesionales del software realmente evalúan el código generado por IA?13/07/2026
  4. 4Zig, Zed, Anthropic: cuando un creador de lenguaje nombra al *hype* por su nombre13/07/2026
  5. 5"Los críticos de los LLM tienen razón. Yo uso LLM de todos modos" - la voz que recomponen16/07/2026
  6. 6El costo de decir que sí ha cambiado: GitHub relanza el debate sobre el verdadero cuello de botella17/07/2026
  7. 7« Claude Code: Anatomía de una mala característica » - cuando la revisión pública se convierte en el verdadero QA17/07/2026
  8. 8El Gemini 3.6 Flash de Google es más económico y breve, y se insinúa el Gemini 4 mientras que el 3.5 Pro sigue en desarrollo22/07/2026
  9. 9La IA no hizo la programación más fácil, solo la hizo difícil de otra manera - CACM lanza la línea anti-hype22/07/2026
  10. 10"La IA estatal no resolverá la desigualdad": la tesis cruda de Rest of World sobre las IA nacionales del Sur global24/07/2026
  11. 11Refactorización como palanca de costo de tokens: un experimento en la serie de gen-AI de Fowler30/07/2026
  12. 12Rachel Laycock: «La atención se ha convertido en el recurso escaso» - el dev-orchestrator, entre 8 y 12 agentes en paralelo31/07/2026
  13. 13Situational Awareness pierde 67 % en un mes: el juicio de las verdaderas creyentes02/08/2026
  14. 14OpenAI « Astra » habría resuelto 10 problemas abiertos en matemáticas e informática: esperemos las pruebas02/08/2026
  15. 15« Cancelling Cursor »: la deuda técnica se antepone a la velocidad de las funcionalidades02/08/2026
  16. 16Jeff Dean sobre lo que los equipos de IA hacen mal: el diagnóstico de la tienda que paga cada factura03/08/2026
Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

Get early access
Secciones
Explorar
Información