33k vs 7k tokens: lo que revela la sobrecarga comparada de Claude Code y OpenCode

Seguimiento del caso : Harness Ops : post-mortems et bench des agents en prod· Episodio 2/17

Artesanía Jul 13, 2026 at 02:197Añadir a favoritos

33k vs 7k tokens: lo que revela la sobrecarga comparada de Claude Code y OpenCode
Ilustración : Léa Fontaine

El arnés habla antes del prompt. Lo que dice —y su costo— define ahora el producto.

En términos sencillos

Un benchmark de Systima.ai (12 de julio de 2026) midió lo que Claude Code y OpenCode envían antes de procesar el prompt del usuario: ~33 000 tokens en el caso de Claude Code, ~7 000 en el de OpenCode. La diferencia no es cosmética: es arquitectónica.

El dato

Systima interceptó la API entre el CLI y el modelo: Claude Code envía un system prompt + una descripción de herramientas + un recordatorio de uso que suman ~33k tokens; OpenCode envía ~7k tokens para la misma configuración. En un ciclo de uso medio, esto se traduce en un sobrecoste de tokens facturados y en presión sobre la caché KV.

Análisis

Dos filosofías chocan, y no son neutrales.

Claude Code apuesta por un harness pesado: instrucciones detalladas para las herramientas, ejemplos integrados, contexto de rol rico, salvaguardas explícitas. La apuesta: un system prompt largo reduce la varianza de comportamiento, mejora la obediencia a las reglas y ahorra iteraciones. Coste: tokens de entrada inflados en cada turno.

OpenCode opta por un harness ligero: herramientas mínimas, sistema breve, se deja que el modelo infiera. La apuesta: menos anclas prefabricadas, más flexibilidad, factura más baja. Coste: más varianza, más riesgo de desviaciones cuando la tarea se aleja del happy path.

Bajo el capó

En precio: a ~$3/M tokens de entrada en Claude, 33k tokens por turno × N turnos de conversación, son varios céntimos por sesión que el usuario nunca ve. En la caché KV: Claude Code aprovecha el prompt caching de Anthropic —el prefijo se cachea y se factura ~10 % tras la primera vez—. Ese es el verdadero motor económico. OpenCode, más corto, no cachea gran cosa.

La comparación "justa" no es token bruto, sino token facturado efectivo (con caché) × calidad de salida × número de reintentos. Systima solo mide uno de los tres. La diferencia real de facturación probablemente ronde los 2× en lugar de 5×, pero sigue siendo significativa.

Escenarios

  • Convergencia (50 %) : Claude Code aligera su preámbulo, OpenCode añade ejemplos; ambos convergen hacia 10-15k tokens.
  • Divergencia asumida (35 %) : Claude Code mantiene su posición de "harness pesado, alta obediencia" (empresa), OpenCode sigue con "harness ligero, control del usuario" (independiente).
  • Nuevo patrón (15 %) : aparición de un harness modular (carga condicional de herramientas según el prompt).

¿Y qué?

El harness se convierte en un diferenciador de producto. Comparar dos CLI de agente es comparar dos tesis sobre qué debe saber el modelo antes de leer al usuario. Para un builder: mida su propio preámbulo y su coste efectivo con caché. Para un directivo: la latencia percibida y la factura mensual dependen de una elección arquitectónica que nadie menciona en la demo comercial.

A vigilar

La publicación por parte de Anthropic u OpenAI de un "harness reference"; la aparición de herramientas que midan la sobrecarga real por CLI; la llegada de modos "diet" oficiales en Claude Code o Cursor.

Resources

Artículo producido por inteligencia artificial, revisado bajo control editorial humano.

Nuestra redacción
Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

SSHMonitoringAI Ops
Get early access
¿Te ha resultado útil este artículo?

5 personas han valorado este artículo

Me gusta
M
Mateo RossiSoftware architect
🇬🇧 Architect, two decades of production systems.
Compartir:
Comentarios (7)

Inicia sesión para unirte a la conversación.

Alex_LDN 13 Jul 2026 · 05:56

Est-ce que ces 33k tokens en plus améliorent vraiment la précision ? Ou c'est juste un surcoût ?

1
TechSavvy47 13 Jul 2026 · 05:51

Comment ça impacte le budget des petites entreprises ?

GreenThumb 13 Jul 2026 · 05:37

Est-ce que cette surcharge va rendre les modèles moins adaptés aux gros projets ? Plus de tokens, ça veut dire plus de ressources nécessaires.

1
TravelTom 13 Jul 2026 · 05:14

Avec 33k tokens, Claude Code consomme-t-il vraiment plus d'énergie qu'OpenCode ?

1
BookWorm88 13 Jul 2026 · 07:32

Est-ce que Claude Code est vraiment plus énergivore qu'OpenCode ?

SkepticSam 13 Jul 2026 · 04:59

Est-ce que ces différences de tokens impactent vraiment la réactivité des modèles en temps réel ?

1
J.P.R. 13 Jul 2026 · 04:40

Intéressant, mais comment ça se répercute sur l'usage concret ?

LitLover42 13 Jul 2026 · 04:07

Comment ça impacte la performance et le prix final ?

1
El hilo del caso

Harness Ops : post-mortems et bench des agents en prod

  1. 1Migrar un agente de producción a GPT-5.6: 2,2× más rápido, 27 % más económico - el verdadero informe post mortem13/07/2026
  2. 233k vs 7k tokens: lo que revela la sobrecarga comparada de Claude Code y OpenCode13/07/2026
  3. 3Google Genkit v.Agents: *detached turns* y *human-in-the-loop* salen en preview14/07/2026
  4. 4Tres bucles en un trench-coat: la anatomía real de un agente14/07/2026
  5. 5« Loop engineering »: ¿nueva disciplina o relanzamiento de los *cron jobs*?15/07/2026
  6. 6Benchmark Stripe: los agentes conectan las API, no las validan15/07/2026
  7. 7El arqueólogo y su copiloto: Malykhin disciplina el LLM en Java 1.516/07/2026
  8. 8QCon AI Boston: « prompts → plataformas, arneses, evaluaciones » - el terreno valida la tesis17/07/2026
  9. 9Más allá de grep: la tesis del arnés de codificación de IA rico en contexto20/07/2026
  10. 10InAgent alcanza 90.2% en OSWorld: la brecha del agente de uso informático se reduce para la pila china03/08/2026
  11. 11Wallfacer: un gestor de sesiones de terminal construido para Claude Code y flujos de trabajo multiagente06/08/2026
  12. 12Claude Code inter-sesión de mensajería se envía: la coordinación entre agentes obtiene su primera primitiva nativa08/08/2026
  13. 13Las habilidades de los agentes de IA se están estandarizando: Codex y VS Code están dentro, Claude aún no.10/08/2026
  14. 14Los agentes de IA mienten, engañan y roban, y esto está frenando su adopción más que cualquier métrica puede medir.13/08/2026
  15. 15La ingeniería de contexto: por qué 300 tokens bien elegidos superan a 100k ruidosos14/08/2026
  16. 16OneCLI (YC S26) incluye un entorno de pruebas aislado de código abierto: la solución a escala de equipo para Claude Code19/08/2026
  17. 17Cursor Origin y el problema de control de versiones de agentes: Por qué Git nunca fue diseñado para esto25/08/2026
Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

Get early access
Secciones
Explorar
Información