33k vs 7k токенов: что показывает сравнительный оверхед Claude Code и OpenCode

Продолжение истории : Harness Ops : post-mortems et bench des agents en prod· Часть 2/10

Ремесло Jul 13, 2026 at 02:197В закладки

33k vs 7k токенов: что показывает сравнительный оверхед Claude Code и OpenCode
Иллюстрация : Léa Fontaine

Харнесс говорит перед промптом. То, что он говорит — и сколько это стоит, — теперь определяет продукт.

Простыми словами

Бенчмарк Systima.ai (12 июля 2026) измерил, что отправляет Claude Code и OpenCode до обработки пользовательского запроса: ~33 000 токенов со стороны Claude Code и ~7 000 со стороны OpenCode. Разница не косметическая — она архитектурная.

Факт

Systima перехватила API между CLI и моделью: Claude Code отправляет system prompt + описание инструментов + напоминание об использовании, что в сумме составляет ~33k токенов; OpenCode отправляет ~7k токенов для той же настройки. В среднем цикле использования это приводит к переплате за токены и давлению на KV-кэш.

Анализ

Соперничают две философии, и они не нейтральны.

Claude Code использует тяжёлый harness: подробные инструкции по инструментам, встроенные примеры, богатый контекст ролей, явные ограничения. Ставка: длинный system prompt снижает вариативность поведения, улучшает подчинение правилам, экономит итерации. Цена: раздутые входные токены на каждом шаге.

OpenCode использует лёгкий harness: минимальный набор инструментов, короткий системный промт, модель сама выводит логику. Ставка: меньше заранее заданных шаблонов, больше гибкости, ниже счёт. Цена: выше вариативность, больше риск отклонения от ожидаемого поведения при выходе за рамки happy path.

Под капотом

По цене: при ~$3/M входных токенов от Claude, 33k токенов за шаг × N шагов в разговоре — это несколько центов за сессию, которые пользователь не видит. По KV-кэшу: Claude Code использует prompt caching от Anthropic — префикс кэшируется и оплачивается на ~10% после первого раза. Это реальный экономический рычаг. OpenCode, с более коротким промтом, почти ничего не кэширует.

Справедливое сравнение — не просто по «сырым» токенам, а по фактически оплачиваемым токенам (с учётом кэша) × качество вывода × количество повторных попыток. Systima измеряет только один из трёх факторов. Реальная разница в оплате, вероятно, ближе к 2×, чем к 5×, но всё равно значительна.

Сценарии

  • Конвергенция (50%): Claude Code сокращает преамбулу, OpenCode добавляет примеры; оба сходятся к 10–15k токенов.
  • Осознанная дивергенция (35%): Claude Code остаётся в позиции «тяжёлый harness, высокая подчинённость» (корпоративный сегмент), OpenCode — «лёгкий harness, контроль пользователя» (индивидуалы).
  • Новый паттерн (15%): появление модульного harness (условная загрузка инструментов в зависимости от запроса).

Что делать

Harness становится ключевым дифференциатором продукта. Сравнивая два CLI агента, мы сравниваем две позиции о том, что модель должна знать до чтения запроса пользователя. Для разработчика: измерьте собственный преамбулярный промт и его фактическую стоимость с учётом кэша. Для руководителя: воспринимаемая задержка и ежемесячный счёт зависят от архитектурного выбора, о котором никто не упоминает в коммерческих демо.

На что обратить внимание

Публикация Anthropic или OpenAI «референсного harness»; появление инструментов, измеряющих реальные накладные расходы для каждого CLI; выход официальных «режимов похудения» у Claude Code или Cursor.

Resources

Статья создана искусственным интеллектом и проверена под редакционным контролем человека.

Наша редакция
Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

SSHMonitoringAI Ops
Get early access
Была ли статья полезной?

5 чел. оценили эту статью

Нравится
M
Mateo RossiSoftware architect
🇬🇧 Architect, two decades of production systems.
Поделиться:
Комментарии (7)

Войдите, чтобы участвовать в обсуждении.

Alex_LDN 13 Jul 2026 · 05:56

Est-ce que ces 33k tokens en plus améliorent vraiment la précision ? Ou c'est juste un surcoût ?

1
TechSavvy47 13 Jul 2026 · 05:51

Comment ça impacte le budget des petites entreprises ?

GreenThumb 13 Jul 2026 · 05:37

Est-ce que cette surcharge va rendre les modèles moins adaptés aux gros projets ? Plus de tokens, ça veut dire plus de ressources nécessaires.

1
TravelTom 13 Jul 2026 · 05:14

Avec 33k tokens, Claude Code consomme-t-il vraiment plus d'énergie qu'OpenCode ?

1
BookWorm88 13 Jul 2026 · 07:32

Est-ce que Claude Code est vraiment plus énergivore qu'OpenCode ?

SkepticSam 13 Jul 2026 · 04:59

Est-ce que ces différences de tokens impactent vraiment la réactivité des modèles en temps réel ?

1
J.P.R. 13 Jul 2026 · 04:40

Intéressant, mais comment ça se répercute sur l'usage concret ?

LitLover42 13 Jul 2026 · 04:07

Comment ça impacte la performance et le prix final ?

1
Хронология истории

Harness Ops : post-mortems et bench des agents en prod

  1. 1Миграция агента продаж на GPT-5.6: в 2,2 раза быстрее, на 27 % дешевле — настоящий разбор после внедрения13/07/2026
  2. 233k vs 7k токенов: что показывает сравнительный оверхед Claude Code и OpenCode13/07/2026
  3. 3Google Genkit v.Agents: отсоединённые диалоги и режим «человек в цикле» выходят в preview14/07/2026
  4. 4Три петли в тренчкоте: анатомия реального агента14/07/2026
  5. 5« Loop engineering » : новая дисциплина или переупаковка cron-задач?15/07/2026
  6. 6Бенчмарк Stripe: агенты подключают API, но не проверяют их15/07/2026
  7. 7Археолог и его штурман: Малыхин приручает LLM для Java 1.516/07/2026
  8. 8QCon AI Boston : « подсказки → платформы, инструменты, оценки » - практика подтверждает тезис17/07/2026
  9. 9За пределами grep: диссертация о контекстно-богатой ИИ-инфраструктуре кодирования20/07/2026
  10. 10InAgent достигает 90,2% на OSWorld: разрыв в использовании компьютерных агентов сокращается для китайского стека03/08/2026
Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

Get early access
Темы
Обзор
Информация