33k vs 7k 토큰 : Claude Code와 OpenCode의 오버헤드 비교가 드러내는 것

진행 중인 이슈 : Harness Ops : post-mortems et bench des agents en prod· 편 2/10

크래프트 Jul 13, 2026 at 02:197북마크에 추가

33k vs 7k 토큰 : Claude Code와 OpenCode의 오버헤드 비교가 드러내는 것
삽화 : Léa Fontaine

하네스가 프롬프트 전에 말을 합니다. 그가 말하는 내용과 가격이 이제 제품의 정체성을 규정합니다.

간단히 말해

Systima.ai(2026년 7월 12일)의 벤치마크에 따르면 Claude Code는 사용자 프롬프트를 처리하기 전에 약 33,000토큰을, OpenCode는 약 7,000토큰을 보낸다고 측정되었다. 이 차이는 단순히 외양의 문제가 아니라 아키텍처의 차이이다.

사실

Systima는 CLI와 모델 간의 API를 가로채 측정한 결과, Claude Code는 시스템 프롬프트 + 도구 설명 + 사용법 총 33k 토큰을, OpenCode는 동일한 설정에서 7k 토큰을 전송했다. 평균 사용 주기에서 이는 청구되는 토큰의 추가 비용과 KV 캐시 압박으로 이어진다.

분석

두 가지 철학이 대립하며, 이는 중립적이지 않다.

Claude Code는 무거운 하네스를 사용한다: 상세한 도구 설명, 포함된 예시, 풍부한 역할 맥락, 명시적 안전장치. 베팅: 긴 시스템 프롬프트는 행동 변동성을 줄이고 규칙 준수를 개선하며 반복을 절약한다. 비용: 매 턴마다 입력 토큰이 증가한다.

OpenCode는 가벼운 하네스를 사용한다: 최소한의 도구, 짧은 시스템 메시지, 모델이 추론하도록 둔다. 베팅: 사전 제작된 앵커가 적어 더 유연하고 청구액이 적다. 비용: 변동성이 크고, 작업이 happy path에서 벗어날 때 행동 편차가 발생할 위험이 있다.

내부 구조

가격 면에서: 입력 토큰당 약 $3/M인 Claude에서 33k 토큰 × N회 대화는 사용자가 결코 보지 못하는 세션당 몇 센트에 달한다. KV 캐시 면에서: Claude Code는 Anthropic의 프롬프트 캐싱을 활용한다. 접두사가 캐시되어 첫 번째 이후 약 10%만 청구된다. 이것이 진정한 경제적 레버리지다. OpenCode는 더 짧아 캐시할 것이 거의 없다.

‘공정한’ 비교는 순수한 토큰이 아니라 실제 청구 토큰(캐시 포함) × 출력 품질 × 재시도 횟수다. Systima는 이 중 하나만 측정했다. 실제 청구액 차이는 5배보다는 2배에 더 가까울 것이지만, 여전히 유의미하다.

시나리오

  • 수렴(50%): Claude Code가 서두를 가볍게 하고 OpenCode가 예시를 추가하면 두 CLI는 10~15k 토큰으로 수렴한다.
  • 의도된 분기(35%): Claude Code는 ‘무거운 하네스, 높은 순응도’(기업용)로, OpenCode는 ‘가벼운 하네스, 사용자 제어’(독립 개발자용)로 남는다.
  • 새로운 패턴(15%): 조건부 도구 로딩 등 모듈형 하네스가 등장한다.

결론

하네스가 제품의 차별화 요소가 된다. 두 에이전트 CLI를 비교하는 것은 모델이 사용자 프롬프트를 읽기 전에 무엇을 알고 있어야 하는지에 대한 두 가지 주장을 비교하는 것이다. 빌더에게: 자신의 서두와 캐시 포함 실제 비용을 측정하라. 경영자에게: 인지된 지연과 월별 청구액은 데모에서 언급조차 되지 않는 아키텍처 선택에 달려 있다.

주시할 점

Anthropic 또는 OpenAI가 ‘하네스 레퍼런스’를 발표하는지; 각 CLI의 실제 오버헤드를 측정하는 도구가 emergence하는지; Claude Code나 Cursor에서 공식 ‘다이어트 모드’가 등장하는지.

Resources

인공지능이 작성하고 사람의 편집 감독하에 검수한 기사입니다.

편집팀
Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

SSHMonitoringAI Ops
Get early access
이 기사가 도움이 되었나요?

5 명이 이 기사를 좋아합니다

좋아요
M
Mateo RossiSoftware architect
🇬🇧 Architect, two decades of production systems.
공유:
댓글 (7)

토론에 참여하려면 로그인하세요.

Alex_LDN 13 Jul 2026 · 05:56

Est-ce que ces 33k tokens en plus améliorent vraiment la précision ? Ou c'est juste un surcoût ?

1
TechSavvy47 13 Jul 2026 · 05:51

Comment ça impacte le budget des petites entreprises ?

GreenThumb 13 Jul 2026 · 05:37

Est-ce que cette surcharge va rendre les modèles moins adaptés aux gros projets ? Plus de tokens, ça veut dire plus de ressources nécessaires.

1
TravelTom 13 Jul 2026 · 05:14

Avec 33k tokens, Claude Code consomme-t-il vraiment plus d'énergie qu'OpenCode ?

1
BookWorm88 13 Jul 2026 · 07:32

Est-ce que Claude Code est vraiment plus énergivore qu'OpenCode ?

SkepticSam 13 Jul 2026 · 04:59

Est-ce que ces différences de tokens impactent vraiment la réactivité des modèles en temps réel ?

1
J.P.R. 13 Jul 2026 · 04:40

Intéressant, mais comment ça se répercute sur l'usage concret ?

LitLover42 13 Jul 2026 · 04:07

Comment ça impacte la performance et le prix final ?

1
Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

Get early access
토픽
탐색
정보