Anthropicは、エージェントのスケーリング方法(レイヤー、トークン、信頼性のある実行)に関するマニュアルを公開

継続中のトピック : Le coût du token entre dans le budget : quotas, CFO et rationnement de l'IA· パート 2/8

ビルド Jul 15, 2026 at 12:344ブックマークに追加

Anthropicは、エージェントのスケーリング方法(レイヤー、トークン、信頼性のある実行)に関するマニュアルを公開
イラスト : Léa Fontaine

二人のAnthropicのエンジニアが現場の教訓を発表:スケールするエージェントにおいて、もはやモデルが制限要因ではなく、ハーネスが制限要因となる。三つの柱:レイヤー、予算、実行。

簡単に言えば Anthropicのエンジニア、Angela JiangとKatelyn Lesseが、顧客企業におけるAIエージェントの産業化から得た教訓を公開。メッセージ:スケーリングの障壁はモデルではなく、その周囲のアーキテクチャにある。3つの柱:スタックを層に分割、厳格なトークン予算を維持、実行を保証。

背景

2025年の主流の議論は「モデルが解決する」だった。Anthropicの実体験が2026年に再評価:長時間のエージェントワークフローでは、信頼性はモデルではなくハーネス(実行基盤)に依存。これは我々が追う流れと一致:トークン当たりのコストが運用コストに転嫁され、Adam MosseriはMetaでエンジニアごとのトークン上限を示唆、UberやMicrosoftでは予算超過でAIライセンスが停止される。

データ

  • 一次ソース:Angela Jiang & Katelyn Lesse(Anthropic)の公開資料、Tech in Asia(2026/07/15)が報告
  • 主要メッセージ:企業のAIスケーリングは、優れたモデルよりも、層化アーキテクチャ、トークン戦略、信頼性の高い実行に依存

中身

層化アーキテクチャのパターンは、実務で3つの責任を分離:

  1. オーケストレーション - どのエージェントを、どのトークン予算で、いつ実行するかを決定。予算超過時は実行を拒否する層。
  2. 実行 - 各ツールコールをリトライ、タイムアウト、出力検証、冪等性で実行。デモでは動くエージェントが、本番ではインシデントになる原因。
  3. 状態 - ターン間で生存させるべきものを永続化:成果物と意思決定のみ。会話コンテキストはコストがかかるため、節約される。

トークン予算は構造的制約:エージェントが1回の実行で50万トークンを消費し、1日1000回実行されれば、コストは新人エンジニアの給与を超える。そのため予算はアーキテクチャレベルで管理される。

シナリオとリスク

  • 短期:トークン上限なしでエージェントを構築したチームはCFOに追及される(token-budget-capsの流れはUber、Microsoft、Mosseriの事例を既に文書化)。
  • 製品リスク:信頼性の高い実行には計装(トレース、リプレイ、実行当たりコスト)が必須だが、ほとんどのエージェントデモはこれを無視。多くのPOCはこの計装コストに耐えられない。

結論

2026年にエージェントプロジェクトをリードするエンジニアリーダーへ:第1フェーズはプロンプトエンジニアリングではなく、予算とトレース。機能を追加する前に、実行当たりのコストを計測せよ。さもなければ、エージェントがようやく動き始めたまさにその時に、財務との会話が最悪のタイミングで訪れる。

リソース

本記事は人工知能により作成され、人間の編集管理のもとで校閲されています。

編集部について
Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

SSHMonitoringAI Ops
Get early access
この記事は役に立ちましたか?

30 人がこの記事を評価しました

いいね
A
Aiko NakamuraSenior software engineer
🇬🇧 Senior engineer, large-scale platforms. Writes about building with AI.
シェア:
コメント (4)

ログインして議論に参加しましょう。

HistoryBuff 15 Jul 2026 · 09:07

Comment ça marche avec plusieurs APIs ?

Dr. J. 15 Jul 2026 · 08:27

Intéressant, mais comment adapter ça à des modèles plus petits et spécialisés ?

GreenThumb 15 Jul 2026 · 10:42

Des modèles plus petits pourraient suivre ces principes, mais les contraintes de ressources seraient différentes.

TravelTom 15 Jul 2026 · 08:17

Comment le budget de tokens influence-t-il la capacité de l'agent à gérer des tâches complexes et multi-étapes ?

CriticAtHeart 15 Jul 2026 · 07:59

Intéressant, mais comment éviter que la complexité du système ne nuise à la performance ?

Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

Get early access
テーマ
探索
インフォメーション