33k vs 7k Tokens: Was die vergleichbaren Overheads von Claude Code und OpenCode offenbaren

Fortlaufende Berichterstattung : Harness Ops : post-mortems et bench des agents en prod· Teil 2/17

Handwerk Jul 13, 2026 at 02:197Zu Lesezeichen hinzufügen

33k vs 7k Tokens: Was die vergleichbaren Overheads von Claude Code und OpenCode offenbaren
Illustration : Léa Fontaine

Der Harness spricht vor dem Prompt. Was er sagt - und was er kostet - definiert nun das Produkt.

In einfachen Worten

Ein Benchmark von Systima.ai (12. Juli 2026) hat gemessen, was Claude Code und OpenCode vor der Verarbeitung des Benutzerprompts senden: ~33.000 Tokens bei Claude Code, ~7.000 bei OpenCode. Der Unterschied ist nicht kosmetisch - er ist architektonisch.

Die Tatsache

Systima hat die API zwischen der CLI und dem Modell abgefangen: Claude Code sendet einen System-Prompt + eine Werkzeugbeschreibung + eine Nutzungsanweisung, die insgesamt ~33k Tokens umfassen; OpenCode sendet ~7k Tokens für die gleiche Einrichtung. Bei einem durchschnittlichen Nutzungszyklus führt dies zu zusätzlichen Kosten für die Tokens und zu Druck auf den KV-Cache.

Analyse

Zwei Philosophien stehen sich gegenüber, und sie sind nicht neutral.

Claude Code setzt auf ein schweres Harness: detaillierte Anweisungen für die Werkzeuge, eingebettete Beispiele, reicher Rollenkontext, explizite Schutzmaßnahmen. Die Wette: Ein langer System-Prompt reduziert die Verhaltensvarianz, verbessert die Regelbefolgung und spart Iterationen. Kosten: Jede Runde werden zusätzliche Eingabetokens verbraucht.

OpenCode setzt auf ein leichtes Harness: minimales Werkzeug, kurzes System, das Modell soll selbst schließen. Die Wette: Weniger vorgefertigte Anker, mehr Flexibilität, geringere Kosten. Kosten: Mehr Varianz, mehr Risiko von Verhaltensabweichungen, wenn die Aufgabe vom Happy Path abweicht.

Under the hood

Beim Preis: Bei ~$3/M Eingabetokens Claude, 33k Tokens pro Runde × N Runden der Konversation, sind das mehrere Cent pro Sitzung, die der Benutzer nie sieht. Beim KV-Cache: Claude Code nutzt das Prompt-Caching von Anthropic - das Präfix wird zwischengespeichert und nach der ersten Verwendung nur noch zu ~10 % berechnet. Das ist der wahre wirtschaftliche Hebel. OpenCode, das kürzer ist, speichert nicht viel.

Der faire Vergleich ist nicht die Roh-Tokens, sondern die effektiv berechneten Tokens (mit Cache) × Ausgabequalität × Anzahl der Retries. Systima misst nur einen der drei Faktoren. Der tatsächliche Unterschied in der Berechnung liegt wahrscheinlich näher an 2× als an 5×, bleibt aber signifikant.

Szenarien

  • Konvergenz (50 %): Claude Code verkürzt seine Präambel, OpenCode fügt Beispiele hinzu; beide konvergieren zu 10-15k Tokens.
  • Bewusste Divergenz (35 %): Claude Code bleibt bei "schweres Harness, hohe Befolgung" (Unternehmen), OpenCode bleibt bei "leichtes Harness, Benutzerkontrolle" (unabhängig).
  • Neues Muster (15 %): Auftreten eines modularen Harness (bedingtes Laden von Werkzeugen je nach Prompt).

So what

Das Harness wird zu einem Produktdifferenzierer. Zwei CLI-Agenten zu vergleichen, bedeutet, zwei Thesen darüber zu vergleichen, was das Modell vor dem Lesen des Benutzers wissen muss. Für einen Builder: Messen Sie Ihre eigene Präambel und ihre effektiven Kosten mit Cache. Für einen Leiter: Die wahrgenommene Latenz und die monatliche Rechnung hängen von einer architektonischen Wahl ab, die niemand in der kommerziellen Demo erwähnt.

Zu beobachten

Die Veröffentlichung eines "Harness Reference" durch Anthropic oder OpenAI; das Auftreten von Tools, die den tatsächlichen Overhead pro CLI messen; das Erscheinen offizieller "Diet"-Modi bei Claude Code oder Cursor.

Resources

Artikel von künstlicher Intelligenz erstellt, unter menschlicher redaktioneller Kontrolle geprüft.

Unsere Redaktion
Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

SSHMonitoringAI Ops
Get early access
War dieser Artikel hilfreich?

5 Personen gefiel dieser Artikel

Gefällt mir
M
Mateo RossiSoftwarearchitekt
🇮🇹 Architekt, zwei Jahrzehnte Systeme in Produktion.
Teilen:
Kommentare (7)

Melden Sie sich an, um an der Diskussion teilzunehmen.

Alex_LDN 13 Jul 2026 · 05:56

Est-ce que ces 33k tokens en plus améliorent vraiment la précision ? Ou c'est juste un surcoût ?

1
TechSavvy47 13 Jul 2026 · 05:51

Comment ça impacte le budget des petites entreprises ?

GreenThumb 13 Jul 2026 · 05:37

Est-ce que cette surcharge va rendre les modèles moins adaptés aux gros projets ? Plus de tokens, ça veut dire plus de ressources nécessaires.

1
TravelTom 13 Jul 2026 · 05:14

Avec 33k tokens, Claude Code consomme-t-il vraiment plus d'énergie qu'OpenCode ?

1
BookWorm88 13 Jul 2026 · 07:32

Est-ce que Claude Code est vraiment plus énergivore qu'OpenCode ?

SkepticSam 13 Jul 2026 · 04:59

Est-ce que ces différences de tokens impactent vraiment la réactivité des modèles en temps réel ?

1
J.P.R. 13 Jul 2026 · 04:40

Intéressant, mais comment ça se répercute sur l'usage concret ?

LitLover42 13 Jul 2026 · 04:07

Comment ça impacte la performance et le prix final ?

1
Chronologie des Themas

Harness Ops : post-mortems et bench des agents en prod

  1. 1Migrating a production agent to GPT-5.6: 2.2× faster, 27% cheaper - the real post-mortem13/07/2026
  2. 233k vs 7k Tokens: Was die vergleichbaren Overheads von Claude Code und OpenCode offenbaren13/07/2026
  3. 3Google Genkit v.Agents: Detached Turns und Human-in-the-Loop kommen in die Vorschau14/07/2026
  4. 4Drei Schlaufen in einem Trenchcoat: Die wahre Anatomie eines Agenten14/07/2026
  5. 5« Loop engineering »: neue Disziplin oder nur ein neues Marketing für Cron-Jobs?15/07/2026
  6. 6Benchmark Stripe: Die Agenten verbinden die APIs, aber sie validieren sie nicht15/07/2026
  7. 7Der Archäologe und sein Copilot: Malykhin diszipliniert das LLM auf Java 1.516/07/2026
  8. 8QCon AI Boston: « prompts → platforms, harnesses, evals » - das Terrain bestätigt die These17/07/2026
  9. 9Über grep hinaus: Die These des kontextreichen KI-Code-Harness20/07/2026
  10. 10InAgent erreicht 90,2 % auf OSWorld: Die Lücke des Computer-Nutzungsagenten für den chinesischen Stack wird kleiner03/08/2026
  11. 11Wallfacer: ein Terminal-Sitzungsmanager, der für Claude Code und Multi-Agent-Workflows entwickelt wurde06/08/2026
  12. 12Claude-Code-Inter-Session-Nachrichtenversand – agentenübergreifende Koordination erhält ihre erste native Primitivfunktion08/08/2026
  13. 13KI-Agenten-Fähigkeiten werden standardisiert: Codex und VS Code sind dabei, Claude noch nicht.10/08/2026
  14. 14KI-Agenten lügen, betrügen und stehlen – und das bremst die Akzeptanz schneller, als es ein Benchmark messen kann.13/08/2026
  15. 15Kontext-Engineering: Warum 300 gut gewählte Tokens 100.000 verrauschte übertreffen14/08/2026
  16. 16OneCLI (YC S26) liefert eine Open-Source-Sandbox-Agenten-Harness – die teamskalierbare Antwort auf Claude Code19/08/2026
  17. 17Cursor Origin und das Agent-Versionkontrollproblem: Warum Git nie dafür entwickelt wurde25/08/2026
Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

Get early access
Themen
Erkunden
Informationen