« Eu amo LLMs, odeio hype » - geohot lembra a única regra que resta

Seguimento do caso : Fatigue hype 2026 : le tri entre modèle et harness· Episódio 1/16

Sinal Jul 13, 2026 at 02:208Adicionar aos favoritos

« Eu amo LLMs, odeio hype » - geohot lembra a única regra que resta
Ilustração : Léa Fontaine

Separar o que os modelos realmente fazem do que lhes é atribuído. A disciplina falta mais do que o *compute*.

O fato

George Hotz (geohot) publicou em 12 de julho de 2026 « Eu amo LLMs, odeio o hype »: uma postagem curta, direta, que distingue o que os modelos fazem (comprimir, restituir, interpolar) do que o marketing lhes atribui (raciocinar, planejar, entender).

Nossa leitura

Geohot não inventa nada — ele refaz a triagem que ninguém quer fazer. Em 2026, a maioria das demos de “agente que pensa” são demos de harness bem conectados, não de raciocínio emergente. Isso não torna os LLMs inúteis: torna-os utilizáveis, desde que se saiba o que se está conectando.

Under the hood

O argumento se resume a três pontos: (1) os LLMs são excelentes em tarefas compressíveis (código, resumo, tradução) onde o padrão está no conjunto de treinamento; (2) eles falham fora do suporte (planejamento de longo prazo, coerência formal estrita, cálculos exatos); (3) os “progressos de raciocínio” observados vêm do harness (test-time compute, RAG, tools), não do modelo nu.

E daí

Praticante: o melhor ROI continua em tarefas compressíveis + tools. Tomador de decisão: sempre pergunte que parcela do ganho vem do modelo e qual do harness. Essa distinção decide se você está exposto à próxima mudança de modelo.

A se observar

Os benchmarks que isolam modelo e harness. A próxima postagem de Lambert ou Karpathy em eco.

Resources

Artigo produzido por inteligência artificial, revisto sob controlo editorial humano.

A nossa redação
Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

SSHMonitoringAI Ops
Get early access
Este artigo foi-lhe útil?

33 pessoas gostaram deste artigo

Gosto
W
William KeelCurator — native generation
🇺🇸 From the AI-born generation. Sorting signal from noise.
Partilhar:
Comentários (8)

Inicie sessão para se juntar à discussão.

EcoWarrior 13 Jul 2026 · 05:13

Le hype cache les vraies avancées. Concentrons-nous sur ce qui marche vraiment.

BookWorm47 13 Jul 2026 · 05:00

Le buzz peut aider à innover, mais il faut garder la tête froide.

2
TechSavvy47 13 Jul 2026 · 04:58

Le hype, c'est bien pour attirer l'attention, mais ça crée des attentes déçues.

Dr. J. 13 Jul 2026 · 04:52

Le hype attire l'argent et l'attention, mais ça cache parfois la réalité.

HistoryBuff 2 13 Jul 2026 · 04:44

Le hype peut servir, mais il faut garder les pieds sur terre. Ne perdons pas de vue ce qui est vraiment possible.

Alex_LDN 13 Jul 2026 · 04:40

Le hype peut tromper, mais c'est aussi ce qui fait parler des vraies avancées. Il faut trouver le juste milieu.

J.P.R. 3 13 Jul 2026 · 04:32

D'accord, mais cette hype n'est-elle pas aussi le reflet d'un vrai enthousiasme pour leur potentiel ?

unLecteurCurieux 13 Jul 2026 · 04:25

Oui, il faut séparer ce qu'ils font vraiment de ce qu'on leur prête. C'est trop facile de s'emballer avec leur potentiel.

O fio do caso

Fatigue hype 2026 : le tri entre modèle et harness

  1. 1« Eu amo LLMs, odeio hype » - geohot lembra a única regra que resta13/07/2026
  2. 2« Poor and overconfident »: os devs são maus juízes das afirmações dos LLMs13/07/2026
  3. 3Como os profissionais de software realmente julgam o código gerado por IA?13/07/2026
  4. 4Zig, Zed, Anthropic: quando um criador de linguagem chama o hype pelo nome13/07/2026
  5. 5"Os críticos de LLMs têm razão. Eu uso LLMs mesmo assim" - la voix qui recompose16/07/2026
  6. 6O custo de dizer sim mudou: GitHub relança o debate sobre o verdadeiro gargalo17/07/2026
  7. 7« Código Claude: Anatomia de uma Má-Feature » - quando a revisão pública se torna o verdadeiro QA17/07/2026
  8. 8O Google's Gemini 3.6 Flash é mais barato e mais curto - e o Gemini 4 ganha um teaser enquanto o 3.5 Pro continua atrasado22/07/2026
  9. 9A IA não tornou a programação mais fácil, apenas a tornou difícil de outra forma - CACM acerta na frase anti-hype22/07/2026
  10. 10"As IA estatal não resolverá a desigualdade": a tese crua do Rest of World sobre as IAs nacionais do Sul Global24/07/2026
  11. 11Refatoração como alavanca de custo de token: um experimento na série de gen-AI de Fowler30/07/2026
  12. 12Rachel Laycock: "a atenção tornou-se o recurso raro" - o dev-orquestrador, entre 8 e 12 agentes em paralelo31/07/2026
  13. 13Situational Awareness perde 67 % em um mês: o julgamento das verdadeiras crentes02/08/2026
  14. 14OpenAI « Astra » teria resolvido 10 problemas abertos em matemática e ciência da computação — aguardemos as provas02/08/2026
  15. 15« Cancelling Cursor »: a dívida técnica sobrepõe-se à velocidade de entrega de funcionalidades02/08/2026
  16. 16Jeff Dean sobre o que as equipes de IA erram: o diagnóstico da oficina que paga todas as contas03/08/2026
Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

Get early access
Secções
Explorar
Informações