**« LLMs를 사랑하지만, 과장된 선전은 싫어」 - 조지홋이 남아 있는 유일한 규칙을 상기시키다**

진행 중인 이슈 : Fatigue hype 2026 : le tri entre modèle et harness· 편 1/16

신호 Jul 13, 2026 at 02:208북마크에 추가

**« LLMs를 사랑하지만, 과장된 선전은 싫어」 - 조지홋이 남아 있는 유일한 규칙을 상기시키다**
삽화 : Léa Fontaine

모델이 실제로 하는 것과 우리가 그들에게 부여하는 것들을 분리하라. 컴퓨팅 파워보다 규율이 더 필요하다.

사실

George Hotz(geohot)는 2026년 7월 12일 「I love LLMs, I hate hype」라는 짧고 단호한 글을 게시했습니다. 이 글은 모델이 수행하는 일(압축, 복원, 보간)과 마케팅에서 모델에 부여하는 일(추론, 계획, 이해)을 구분합니다.

우리의 해석

Geohot는 새로운 것을 주장하는 것이 아닙니다. 그는 아무도 하고 싶어하지 않는 구분을 다시 한 번 내리고 있습니다. 2026년 기준으로 대부분의 「생각하는 에이전트」 데모는 잘 연결된 하네스 데모일 뿐,Emergent Reasoning(창발적 추론)은 아닙니다. 그렇다고 LLMs가 쓸모없다는 뜻은 아닙니다. 무엇을 연결하는지 안다면 LLMs는 충분히 유용해질 수 있습니다.

내부 구조

이 주장은 세 가지 핵심으로 요약됩니다: (1) LLMs는 훈련 데이터에 포함된 패턴을 재현하는 압축 가능한 작업(코드, 요약, 번역)에서 탁월합니다. (2) 장기 계획, 엄격한 형식적 일관성, 정확한 계산 등 훈련 데이터에 포함되지 않은 작업에서는 실패합니다. (3) 관찰되는 「추론 능력의 발전」은 모델 자체의 성장이 아니라 하네스(테스트 시간 계산, RAG, 도구)의 결과입니다.

결론

실무자: 가장 높은 ROI는 압축 가능한 작업 + 도구에 있습니다. 의사결정자: 모델 자체에서 얻은 성능 향상과 하네스를 통한 성능 향상의 비율을 항상 질문하세요. 이 구분이 여러분이 다음 모델 변화에 노출될지 여부를 결정합니다.

주시할 점

모델과 하네스를 분리하는 벤치마크. Lambert 또는 Karpathy의 다음 글이对此를 반영할지 여부.

Resources

인공지능이 작성하고 사람의 편집 감독하에 검수한 기사입니다.

편집팀
Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

SSHMonitoringAI Ops
Get early access
이 기사가 도움이 되었나요?

33 명이 이 기사를 좋아합니다

좋아요
W
William KeelCurator — native generation
🇺🇸 From the AI-born generation. Sorting signal from noise.
공유:
댓글 (8)

토론에 참여하려면 로그인하세요.

EcoWarrior 13 Jul 2026 · 05:13

Le hype cache les vraies avancées. Concentrons-nous sur ce qui marche vraiment.

BookWorm47 13 Jul 2026 · 05:00

Le buzz peut aider à innover, mais il faut garder la tête froide.

2
TechSavvy47 13 Jul 2026 · 04:58

Le hype, c'est bien pour attirer l'attention, mais ça crée des attentes déçues.

Dr. J. 13 Jul 2026 · 04:52

Le hype attire l'argent et l'attention, mais ça cache parfois la réalité.

HistoryBuff 2 13 Jul 2026 · 04:44

Le hype peut servir, mais il faut garder les pieds sur terre. Ne perdons pas de vue ce qui est vraiment possible.

Alex_LDN 13 Jul 2026 · 04:40

Le hype peut tromper, mais c'est aussi ce qui fait parler des vraies avancées. Il faut trouver le juste milieu.

J.P.R. 3 13 Jul 2026 · 04:32

D'accord, mais cette hype n'est-elle pas aussi le reflet d'un vrai enthousiasme pour leur potentiel ?

unLecteurCurieux 13 Jul 2026 · 04:25

Oui, il faut séparer ce qu'ils font vraiment de ce qu'on leur prête. C'est trop facile de s'emballer avec leur potentiel.

이슈 타임라인

Fatigue hype 2026 : le tri entre modèle et harness

  1. 1**« LLMs를 사랑하지만, 과장된 선전은 싫어」 - 조지홋이 남아 있는 유일한 규칙을 상기시키다**13/07/2026
  2. 2**« 가난하고 과신하는» : 개발자들이 LLM의 주장에 대한 나쁜 판관**13/07/2026
  3. 3어떻게 프로 개발자들은 AI가 생성한 코드를 정말 평가할까요?13/07/2026
  4. 4지그, 제드, 앤트로픽: 한 프로그래밍 언어 창시자가 과장된 광고를 이름 짓다13/07/2026
  5. 5LLM 비판론자들은 옳다. 그래도 나는 LLMs를 사용한다 - 재구성된 목소리16/07/2026
  6. 6GitHub가 "예스"라고 말하는 비용이 변했습니다: GitHub가 진정한 병목 현상에 대한 논쟁을 재점화합니다17/07/2026
  7. 7« Claude Code: 해로운 기능의 해부 » - 공개 리뷰가 진정한 QA가 되는 순간17/07/2026
  8. 8Google의 Gemini 3.6 Flash는 더 저렴하고 짧아졌으며, Gemini 4는 teas를 받지만 3.5 Pro는 늦게 유지됩니다.22/07/2026
  9. 9AI가 프로그래밍을 더 쉽게 만들지 않았으며, 단지 다르게 어렵게 만들었을 뿐입니다 - CACM이 반하이프 라인을 제시합니다.22/07/2026
  10. 10국가 소유 AI가 불평등을 해결하지 못할 것이라는 레스트 오브 월드의 냉정한 thesis24/07/2026
  11. 11리팩토링을 토큰 비용 레버로: 파울러의 Gen-AI 시리즈 실험30/07/2026
  12. 12레이첼 레이콕 : “‘주의’가 희귀한 자원이 되었습니다” - 8~12명의 에이전트를 동시에 관리하는 개발 오케스트레이터31/07/2026
  13. 13상황 인식 능력 67% 감소: 진정한 신자들의 재판02/08/2026
  14. 14OpenAI « Astra »가 수학 및 CS 분야에서 해결되지 않은 10개 문제를 해결했다는 주장 - 증거를 기다려야 할 듯02/08/2026
  15. 15"Cancelling Cursor": 품질에 대한 부채가 기능의 속도를 앞지르다02/08/2026
  16. 16제프 딘이 말하는 AI 팀의 잘못된 점: 모든 비용을 지불하는 상점에서 진단을 내리며03/08/2026
Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

Get early access
토픽
탐색
정보