33k vs 7k tokens : ce que révèle l'overhead comparé de Claude Code et OpenCode

Suivi de l'affaire : Harness Ops : post-mortems et bench des agents en prod· Épisode 2/17

Craft 13/07/2026 à 02h197Ajouter aux favoris

33k vs 7k tokens : ce que révèle l'overhead comparé de Claude Code et OpenCode
Illustration : Léa Fontaine

Le harness parle avant le prompt. Ce qu'il dit - et combien il coûte - définit désormais le produit.

In plain terms

Un benchmark de Systima.ai (12 juillet 2026) a mesuré ce que Claude Code et OpenCode envoient avant de traiter le prompt utilisateur : ~33 000 tokens côté Claude Code, ~7 000 côté OpenCode. La différence n'est pas cosmétique - elle est architecturale.

Le fait

Systima a intercepté l'API entre le CLI et le modèle : Claude Code envoie un system prompt + une description d'outils + un rappel d'usage totalisant ~33k tokens ; OpenCode envoie ~7k tokens pour le même setup. Sur un cycle d'usage moyen, ça se traduit en surcoût de tokens facturés et en pression sur le KV cache.

Analyse

Deux philosophies s'opposent, et elles ne sont pas neutres.

Claude Code joue le harness lourd : instructions détaillées pour l'outillage, exemples embarqués, contexte de rôle riche, garde-fous explicites. Le pari : un system prompt long réduit la variance de comportement, améliore l'obéissance aux règles, économise des itérations. Coût : tokens d'entrée dopés à chaque tour.

OpenCode joue le harness léger : outillage minimal, système court, on laisse le modèle inférer. Le pari : moins d'ancres pré-fabriquées, plus de flexibilité, plus faible facture. Coût : plus de variance, plus de risque d'écart de comportement quand la tâche s'écarte du happy path.

Under the hood

Sur le prix : à ~$3/M tokens input Claude, 33k tokens par tour × N tours de conversation, c'est plusieurs centimes par session que l'utilisateur ne voit jamais. Sur le KV cache : Claude Code exploite le prompt caching d'Anthropic - le préfixe est mis en cache et facturé ~10 % après la première fois. C'est le vrai levier économique. OpenCode, plus court, ne cache pas grand-chose.

Le comparatif « juste » n'est pas token-brut mais token-facturé effectif (avec cache) × qualité de sortie × nombre de retries. Systima ne mesure qu'un des trois. La différence de facturation réelle est probablement plus proche de 2× que de 5×, mais reste significative.

Scénarios

  • Convergence (50 %) : Claude Code allège son préambule, OpenCode ajoute des exemples ; les deux convergent vers 10-15k tokens.
  • Divergence assumée (35 %) : Claude Code reste positionné « harness lourd, obéissance haute » (entreprise), OpenCode reste « harness léger, contrôle utilisateur » (indépendant).
  • Nouveau pattern (15 %) : émergence d'un harness modulaire (chargement conditionnel d'outils selon le prompt).

So what

Le harness devient un différenciateur produit. Comparer deux CLI d'agent, c'est comparer deux thèses sur ce que le modèle doit savoir avant de lire l'utilisateur. Pour un builder : mesurez votre propre préambule et son coût effectif avec cache. Pour un dirigeant : la latence perçue et la facture mensuelle dépendent d'un choix d'archi que personne dans la démo commerciale ne mentionne.

À surveiller

La publication par Anthropic ou OpenAI d'un « harness reference » ; l'émergence d'outils qui mesurent l'overhead réel par CLI ; l'apparition de modes « diet » officiels chez Claude Code ou Cursor.

Ressources, à tester

Article produit par intelligence artificielle, relu sous contrôle éditorial humain.

Notre rédaction
Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

SSHMonitoringAI Ops
Get early access
Cet article vous a-t-il été utile ?

5 personnes ont aimé cet article

J'aime
M
Mateo RossiArchitecte logiciel
🇮🇹 Architecte, deux décennies de systèmes en production.
Partager :
Commentaires (7)

Connectez-vous pour rejoindre la discussion.

Alex_LDN 13 Jul 2026 · 05:56

Est-ce que ces 33k tokens en plus améliorent vraiment la précision ? Ou c'est juste un surcoût ?

1
TechSavvy47 13 Jul 2026 · 05:51

Comment ça impacte le budget des petites entreprises ?

GreenThumb 13 Jul 2026 · 05:37

Est-ce que cette surcharge va rendre les modèles moins adaptés aux gros projets ? Plus de tokens, ça veut dire plus de ressources nécessaires.

1
TravelTom 13 Jul 2026 · 05:14

Avec 33k tokens, Claude Code consomme-t-il vraiment plus d'énergie qu'OpenCode ?

1
BookWorm88 13 Jul 2026 · 07:32

Est-ce que Claude Code est vraiment plus énergivore qu'OpenCode ?

SkepticSam 13 Jul 2026 · 04:59

Est-ce que ces différences de tokens impactent vraiment la réactivité des modèles en temps réel ?

1
J.P.R. 13 Jul 2026 · 04:40

Intéressant, mais comment ça se répercute sur l'usage concret ?

LitLover42 13 Jul 2026 · 04:07

Comment ça impacte la performance et le prix final ?

1
Le fil de l'affaire

Harness Ops : post-mortems et bench des agents en prod

  1. 1Migrer un agent prod sur GPT-5.6 : 2,2× plus rapide, 27 % moins cher - le vrai post-mortem13/07/2026
  2. 233k vs 7k tokens : ce que révèle l'overhead comparé de Claude Code et OpenCode13/07/2026
  3. 3Google Genkit v.Agents : detached turns et human-in-the-loop sortent en preview14/07/2026
  4. 4Trois boucles dans un trench-coat : l'anatomie réelle d'un agent14/07/2026
  5. 5« Loop engineering » : nouvelle discipline ou re-marketage des cron jobs ?15/07/2026
  6. 6Benchmark Stripe : les agents branchent les API, ils ne les valident pas15/07/2026
  7. 7L'archéologue et son copilote : Malykhin discipline le LLM sur du Java 1.516/07/2026
  8. 8QCon AI Boston : « prompts → platforms, harnesses, evals » - le terrain valide la thèse17/07/2026
  9. 9Au-delà de grep : la thèse du harness de codage IA riche en contexte20/07/2026
  10. 10InAgent hits 90.2% on OSWorld: the computer-use agent gap narrows for the Chinese stack03/08/2026
  11. 11Wallfacer: a terminal session manager built for Claude Code and multi-agent workflows06/08/2026
  12. 12Claude Code inter-session messaging ships - agent-to-agent coordination gets its first native primitive08/08/2026
  13. 13AI agent Skills are getting standardized: Codex and VS Code are in, Claude is not yet10/08/2026
  14. 14AI agents lie, cheat, and steal - and it's slowing adoption faster than any benchmark can measure13/08/2026
  15. 15Context engineering: why 300 well-chosen tokens beat 100k noisy ones14/08/2026
  16. 16OneCLI (YC S26) ships an OSS sandboxed agent harness - the team-scale answer to Claude Code19/08/2026
  17. 17Cursor Origin and the Agent Version Control Problem: Why Git Was Never Designed for This25/08/2026
Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

Get early access
Rubriques
Explorer
Informations