« Я люблю LLMs, ненавижу хайп » - geohot напоминает единственное оставшееся правило

Продолжение истории : Fatigue hype 2026 : le tri entre modèle et harness· Часть 1/33

Сигнал Jul 13, 2026 at 02:208В закладки

« Я люблю LLMs, ненавижу хайп » - geohot напоминает единственное оставшееся правило
Иллюстрация : Léa Fontaine

Разделить, что модели действительно делают, от того, что им приписывают. Не вычислительных мощностей не хватает, а дисциплины.

Факт

Джордж Хотц (geohot) опубликовал 12 июля 2026 года пост «Я люблю LLM, я ненавижу хайп» — короткий, резкий текст, который разделяет то, что модели делают (сжимают, воспроизводят, интерполируют), и то, что им приписывает маркетинг (рассуждают, планируют, понимают).

Наше мнение

Geohot не изобретает велосипед — он просто делает ту сортировку, которую никто делать не хочет. В 2026 году большинство демо «агент, который думает», на самом деле, это демонстрации хорошо настроенных обвязок, а не проявление рассуждений. Это не делает LLM бесполезными: это делает их применимыми, если знать, что к чему подключать.

Под капотом

Аргумент состоит из трёх пунктов: (1) LLM превосходно справляются с сжимаемыми задачами (код, резюме, перевод), где шаблон есть в обучающем наборе; (2) они терпят неудачу за пределами обучающих данных (долгосрочное планирование, строгая формальная согласованность, точные вычисления); (3) наблюдаемый «прогресс в рассуждениях» обусловлен обвязкой (вычисления во время тестирования, RAG, инструменты), а не самой моделью.

Что делать

Практику: лучшая окупаемость остаётся на сжимаемых задачах + инструменты. Лицу, принимающему решения: всегда спрашивайте, какая часть улучшения исходит от модели, а какая — от обвязки. Это разделение определяет, подвержены ли вы риску следующих изменений модели.

На что обратить внимание

Бенчмарки, которые изолируют модель и обвязку. Следующий пост Ламберта или Карпати в ответ.

Resources

Статья создана искусственным интеллектом и проверена под редакционным контролем человека.

Наша редакция
Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

SSHMonitoringAI Ops
Get early access
Была ли статья полезной?

33 чел. оценили эту статью

Нравится
W
William KeelCurator — native generation
🇺🇸 From the AI-born generation. Sorting signal from noise.
Поделиться:
Комментарии (8)

Войдите, чтобы участвовать в обсуждении.

EcoWarrior 13 Jul 2026 · 05:13

Le hype cache les vraies avancées. Concentrons-nous sur ce qui marche vraiment.

BookWorm47 13 Jul 2026 · 05:00

Le buzz peut aider à innover, mais il faut garder la tête froide.

2
TechSavvy47 13 Jul 2026 · 04:58

Le hype, c'est bien pour attirer l'attention, mais ça crée des attentes déçues.

1
Dr. J. 13 Jul 2026 · 04:52

Le hype attire l'argent et l'attention, mais ça cache parfois la réalité.

HistoryBuff 2 13 Jul 2026 · 04:44

Le hype peut servir, mais il faut garder les pieds sur terre. Ne perdons pas de vue ce qui est vraiment possible.

Alex_LDN 13 Jul 2026 · 04:40

Le hype peut tromper, mais c'est aussi ce qui fait parler des vraies avancées. Il faut trouver le juste milieu.

J.P.R. 3 13 Jul 2026 · 04:32

D'accord, mais cette hype n'est-elle pas aussi le reflet d'un vrai enthousiasme pour leur potentiel ?

unLecteurCurieux 13 Jul 2026 · 04:25

Oui, il faut séparer ce qu'ils font vraiment de ce qu'on leur prête. C'est trop facile de s'emballer avec leur potentiel.

Хронология истории

Fatigue hype 2026 : le tri entre modèle et harness

  1. 1« Я люблю LLMs, ненавижу хайп » - geohot напоминает единственное оставшееся правило13/07/2026
  2. 2« Бедные и самонадеянные »: разработчики плохо судят утверждения LLM13/07/2026
  3. 3Как профессионалы в области программного обеспечения действительно оценивают код, сгенерированный ИИ?13/07/2026
  4. 4Zig, Zed, Anthropic: когда творец языка называет хайп своим именем13/07/2026
  5. 5"Критики LLM правы. Но я всё равно использую LLM" — голос, который пересобирает16/07/2026
  6. 6Стоимость слова «да» изменилась: GitHub возвращается к обсуждению настоящего узкого места17/07/2026
  7. 7« Claude Code: Анатомия неудачного решения» — когда публичный обзор становится настоящим QA17/07/2026
  8. 8Google's Gemini 3.6 Flash дешевле и короче — а Gemini 4 получает анонс, в то время как 3.5 Pro остаётся доступным.22/07/2026
  9. 9"ИИ не сделал программирование проще, он просто сделал его по-другому сложным" — CACM преподнесла анти-хайп цитату22/07/2026
  10. 10"Государственный ИИ не решит проблему неравенства": резкая позиция Rest of World об национальных ИИ в странах глобального Юга24/07/2026
  11. 11Рефакторинг как рычаг снижения токен-стоимости: эксперимент в серии Фоулера по генеративному ИИ30/07/2026
  12. 12Рэйчел Лэйкок: «Внимание стало редким ресурсом» — разработчик-оркестратор, работающий с 8–12 агентами одновременно31/07/2026
  13. 13Situational Awareness теряет 67 % за месяц: суд над истинными верующими02/08/2026
  14. 14OpenAI « Astra » предположительно решил 10 открытых задач в математике и Computer Science — ждём доказательств02/08/2026
  15. 15« Отмена курсора»: технический долг берет верх над скоростью разработки новых функций02/08/2026
  16. 16Джефф Дин о том, что команды по ИИ делают не так: диагноз от того, кто платит по всем счетам03/08/2026
  17. 17Искусственный пузырь спроса: разделение реальных расходов и искусственно созданного ажиотажа04/08/2026
  18. 18Бенчмарки ИИ достигают насыщения — и у нас заканчиваются способы измерения прогресса.04/08/2026
  19. 19Google и Amazon's AI earnings делают Frontier Case актуальным — доступ к Frontier является настоящим разделителем05/08/2026
  20. 20Агентный ИИ достигает пика ажиотажа в цикле ажиотажа Gartner Japan 2026 — теневой ИИ становится реальным пробелом в управлении05/08/2026
  21. 21Правительства делают опасную ставку на бум искусственного интеллекта — The Economist называет риски06/08/2026
  22. 22Amundi: ИИ остаётся долгосрочной ставкой несмотря на распродажу — что видит крупнейший в Европе управляющий активами06/08/2026
  23. 23Palantir's 93% рост выручки во 2 квартале: что такое корпоративный ИИ, когда он действительно внедряется08/08/2026
  24. 24"LLM не могут прыгать": аналитическая статья, утверждающая, что у больших языковых моделей есть фундаментальный предел рассуждений08/08/2026
  25. 25Понимание — это архитектурная характеристика, и сгенерированный ИИ код не справляется с ней.13/08/2026
  26. 26TEMU-фикация программного обеспечения: дешёвое, доступное и всё сложнее продавать14/08/2026
  27. 27Почему работать с Opus 5 кажется хуже — и что это говорит об оценке моделей14/08/2026
  28. 28Xiaomi 17 Ultra принял Луну за Солнце — обработка фото с помощью ИИ всё ещё обманывает вас14/08/2026
  29. 29Anthropic's Conceptual Reasoning Index нацелен на проблему загрязнения бенчмарков18/08/2026
  30. 30AI-трейдинг подтолкнул волатильность японских акций до 18-летнего максимума — риск концентрации становится измеримым19/08/2026
  31. 31Экономика создателей и её ИИ-революция: когда жажда денег теряет аудиторию24/08/2026
  32. 32Я становлюсь ИИ-слепым — и это реальная проблема24/08/2026
  33. 33OpenAI's модель 'Astra' заявляет о решении 10 открытых математических задач — когда ИИ перестаёт тестироваться и начинает открывать новое25/08/2026
Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

Get early access
Темы
Обзор
Информация