33k vs 7k tokens: o que revela a sobrecarga comparada do Claude Code e OpenCode

Seguimento do caso : Harness Ops : post-mortems et bench des agents en prod· Episódio 2/17

Fabricação Jul 13, 2026 at 02:197Adicionar aos favoritos

33k vs 7k tokens: o que revela a sobrecarga comparada do Claude Code e OpenCode
Ilustração : Léa Fontaine

O harness fala antes do prompt. O que ele diz — e quanto custa — define agora o produto.

Em termos simples

Um benchmark da Systima.ai (12 de julho de 2026) mediu o que Claude Code e OpenCode enviam antes de processar o prompt do usuário: ~33.000 tokens no lado do Claude Code, ~7.000 no lado do OpenCode. A diferença não é apenas cosmética — é arquitetural.

O fato

A Systima interceptou a API entre o CLI e o modelo: o Claude Code envia um system prompt + uma descrição de ferramentas + um lembrete de uso totalizando ~33k tokens; o OpenCode envia ~7k tokens para a mesma configuração. Em um ciclo de uso médio, isso se traduz em sobrecusto de tokens faturados e pressão no KV cache.

Análise

Duas filosofias se opõem, e não são neutras.

Claude Code adota uma harness pesada: instruções detalhadas para as ferramentas, exemplos embarcados, contexto rico de papel, guardrails explícitos. A aposta: um system prompt longo reduz a variância de comportamento, melhora a obediência às regras e economiza iterações. Custo: tokens de entrada inflados a cada rodada.

OpenCode adota uma harness leve: ferramentas mínimas, sistema curto, deixando o modelo inferir. A aposta: menos âncoras pré-fabricadas, mais flexibilidade, menor fatura. Custo: mais variância, maior risco de desvio de comportamento quando a tarefa se afasta do happy path.

Por baixo do capô

No preço: a ~$3/M tokens de entrada no Claude, 33k tokens por rodada × N rodadas de conversa, são vários centavos por sessão que o usuário nunca vê. No KV cache: o Claude Code explora o prompt caching da Anthropic — o prefixo é armazenado em cache e faturado a ~10% após a primeira vez. Esse é o verdadeiro alavancador econômico. O OpenCode, mais curto, não tem muito o que cachear.

O comparativo “justo” não é o de tokens brutos, mas tokens efetivamente faturados (com cache) × qualidade da saída × número de retries. A Systima mede apenas um dos três. A diferença real de faturamento provavelmente é mais próxima de 2× do que de 5×, mas ainda significativa.

Cenários

  • Convergência (50%): O Claude Code alivia seu preâmbulo, o OpenCode adiciona exemplos; ambos convergem para 10-15k tokens.
  • Divergência assumida (35%): O Claude Code mantém sua posição de “harness pesada, alta obediência” (empresarial), o OpenCode permanece “harness leve, controle do usuário” (independente).
  • Novo padrão (15%): surgimento de uma harness modular (carregamento condicional de ferramentas conforme o prompt).

E então?

A harness se torna um diferencial de produto. Comparar dois CLIs de agente é comparar duas teses sobre o que o modelo deve saber antes de ler o usuário. Para um builder: meça seu próprio preâmbulo e seu custo efetivo com cache. Para um executivo: a latência percebida e a fatura mensal dependem de uma escolha arquitetural que ninguém menciona na demo comercial.

A se observar

A publicação pela Anthropic ou OpenAI de uma “harness reference”; o surgimento de ferramentas que medem a overhead real por CLI; o aparecimento de modos “diet” oficiais no Claude Code ou Cursor.

Resources

Artigo produzido por inteligência artificial, revisto sob controlo editorial humano.

A nossa redação
Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

SSHMonitoringAI Ops
Get early access
Este artigo foi-lhe útil?

5 pessoas gostaram deste artigo

Gosto
M
Mateo RossiSoftware architect
🇬🇧 Architect, two decades of production systems.
Partilhar:
Comentários (7)

Inicie sessão para se juntar à discussão.

Alex_LDN 13 Jul 2026 · 05:56

Est-ce que ces 33k tokens en plus améliorent vraiment la précision ? Ou c'est juste un surcoût ?

1
TechSavvy47 13 Jul 2026 · 05:51

Comment ça impacte le budget des petites entreprises ?

GreenThumb 13 Jul 2026 · 05:37

Est-ce que cette surcharge va rendre les modèles moins adaptés aux gros projets ? Plus de tokens, ça veut dire plus de ressources nécessaires.

1
TravelTom 13 Jul 2026 · 05:14

Avec 33k tokens, Claude Code consomme-t-il vraiment plus d'énergie qu'OpenCode ?

1
BookWorm88 13 Jul 2026 · 07:32

Est-ce que Claude Code est vraiment plus énergivore qu'OpenCode ?

SkepticSam 13 Jul 2026 · 04:59

Est-ce que ces différences de tokens impactent vraiment la réactivité des modèles en temps réel ?

1
J.P.R. 13 Jul 2026 · 04:40

Intéressant, mais comment ça se répercute sur l'usage concret ?

LitLover42 13 Jul 2026 · 04:07

Comment ça impacte la performance et le prix final ?

1
O fio do caso

Harness Ops : post-mortems et bench des agents en prod

  1. 1Migrar um agente de produção para o GPT-5.6: 2,2× mais rápido, 27 % mais barato - a verdadeira autópsia13/07/2026
  2. 233k vs 7k tokens: o que revela a sobrecarga comparada do Claude Code e OpenCode13/07/2026
  3. 3Google Genkit v.Agents: *detached turns* e *human-in-the-loop* entram em preview14/07/2026
  4. 4Três loops em um trench coat: a anatomia real de um agente14/07/2026
  5. 5« Loop engineering »: nova disciplina ou rebranding de cron jobs?15/07/2026
  6. 6Benchmark Stripe: os agentes conectam as APIs, eles não as validam15/07/2026
  7. 7O arqueólogo e seu copiloto: Malykhin disciplina o LLM em Java 1.516/07/2026
  8. 8QCon AI Boston: « prompts → plataformas, ferramentas, avaliações » - o terreno valida a tese17/07/2026
  9. 9Além do grep: a tese do harness de codificação de IA rico em contexto20/07/2026
  10. 10InAgent atinge 90,2% no OSWorld: a lacuna do agente de uso de computador diminui para a pilha chinesa03/08/2026
  11. 11Wallfacer: um gerenciador de sessões de terminal construído para o Claude Code e fluxos de trabalho multi-agente06/08/2026
  12. 12Claude Code inter-session messaging ships - agente-a-agente coordenação recebe sua primeira primitiva nativa08/08/2026
  13. 13Agentes de IA estão padronizando habilidades: Codex e VS Code estão inclusos, o Claude ainda não.10/08/2026
  14. 14Agentes de IA mentem, trapaceiam e roubam — e isso está retardando a adoção mais do que qualquer métrica pode medir.13/08/2026
  15. 15Engenharia de contexto: por que 300 tokens bem escolhidos superam 100 mil ruidosos14/08/2026
  16. 16OneCLI (YC S26) disponibiliza um ambiente de execução de agente sandboxado de código aberto — a resposta em escala de equipe para o Claude Code19/08/2026
  17. 17Origem do Cursor e o Problema de Controle de Versão do Agente: Por Que o Git Nunca Foi Projetado para Isso25/08/2026
Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

Get early access
Secções
Explorar
Informações