三つのループを纏ったトレンチコート:エージェントの実像

継続中のトピック : Harness Ops : post-mortems et bench des agents en prod· パート 4/17

ビルド Jul 14, 2026 at 22:307ブックマークに追加

三つのループを纏ったトレンチコート:エージェントの実像
イラスト : Léa Fontaine

エージェントとは魔法ではない。推論ループ、ツールループ、そしてそれを止める人間だ。仕事の在り方が変わる。プロンプトを書くのではなく、ループを書くのだ。

簡単に言えば

AI「エージェント」を分解すると、3つのループが重なった構造になっている。1つはモデルと対話するループ、1つは要求されたツールを実行するループ、そして最後の1つは人間が「はい」と言うのを待つループだ。最初のループは単純だが、3番目のループはエンジニアリングの悪夢だ。そして開発者の仕事は、プロンプトを書くことから、これらのループを書くことにシフトしつつある。

プロンプトではなくループ

bobbytables.ioの記事は、あまりにも少ない「エージェント的」なコンテンツがやっていることを実践している。つまり、コードを示しているのだ。推論ループはほとんど愚直なwhileループだ。APIを呼び出し、結果を履歴に積み上げ、モデルがツールを要求しなくなったら終了する。モデルがツールを要求すると、ツールループが引き継ぐ。関数名を解決し、関数を呼び出し、tool_call_idに関連付けられた結果を返す。

ここで著者が指摘する罠が隠れている。ツール呼び出しもまた、推論されたテキストなのだ。そのため、関数名とそのパラメータは幻覚する可能性がある。ツールディスパッチャはルーターではなく、攻撃や検証の対象となる表面なのだ。

3番目の人間ループは技術的にはループではない。ブロッキング呼び出しだ。誰かがどこかで続行するかどうかを決定する。人間が返答するのに3日かかることもあり、これがプロセスを破綻させる。そのため、Temporalのような耐久実行エンジンが必要になる。

内部構造

while continueInferenceLoop
 inferred = aiClient.completeChat(messages: chatMessages)
 chatMessages.push(inferred result)
 if inferred.toolCalls.length == 0
 continueInferenceLoop = false
end

たった4行。残りのすべて——履歴の永続化、ツールの冪等性、人間の承認後の再開——は分散システムの古典的なエンジニアリングだ。AIではない。

結論

この構造の産業的な対応物には名前がある。The Pragmatic Engineerが最近文書化したとおり、ループエンジニアリングだ。Addy Osmaniの公式が転換を表している。「You design the system that does it instead」——つまり、要求を記述するのではなく、ループでそれを記述するシステムを設計するのだ。Boris Cherny(Anthropic)はさらに踏み込む。「My job is to write loops」。この技術はGeoffrey Huntleyの「ラルフ・ループ」に由来する。単純なBashループで、エージェントを目標に到達するまで繰り返し呼び出す。

実用化されたユースケースはありふれたものだ。Sentryの新しいチケットに自動でPRを開く、夜間のテストで不安定なテストを修正する、アラートのトリアージ、長期間のマイグレーション。2026年5月から、Codex、Claude Code、Hermesは/goalコマンドでこれらすべてをカプセル化している。

採用する際に求めるスキルは「プロンプトが書ける」ことではない。ループを冪等で、観測可能で、中断可能にするスキルだ。

リソース

本記事は人工知能により作成され、人間の編集管理のもとで校閲されています。

編集部について
Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

SSHMonitoringAI Ops
Get early access
この記事は役に立ちましたか?

8 人がこの記事を評価しました

いいね
A
Aiko NakamuraSenior software engineer
🇬🇧 Senior engineer, large-scale platforms. Writes about building with AI.
シェア:
コメント (7)

ログインして議論に参加しましょう。

GreenThumb 15 Jul 2026 · 06:01

Est-ce que ces boucles peuvent vraiment comprendre les sentiments et l'intuition humaine ?

J.P.R. 2 15 Jul 2026 · 05:49

Est-ce que les boucles peuvent vraiment remplacer la créativité humaine ?

Alex 15 Jul 2026 · 05:28

Comment évaluer la courbe d'apprentissage pour maîtriser ces boucles ? Est-ce vraiment accessible ?

HistoryBuff 15 Jul 2026 · 05:24

Comment adapter ces boucles à des situations imprévues ?

sandrine.b 15 Jul 2026 · 05:18

Est-ce que ces boucles ne vont pas tuer la créativité humaine ?

1
TravelTom 14 Jul 2026 · 18:31

Je suis d'accord, mais comment éviter que l'humain dans la boucle ne devienne inutile ? Quel est l'équilibre ?

EcoWarrior 14 Jul 2026 · 20:40

L'humain reste indispensable pour valider et guider. L'éducation continue est la clé pour rester pertinent.

1
J.P.R. 3 14 Jul 2026 · 18:09

Intéressant, mais à quoi sert l'humain dans la boucle ? On devient juste des surveillants ?

トピックの経過

Harness Ops : post-mortems et bench des agents en prod

  1. 1GPT-5.6 へのプロダクションエージェントの移行:2.2倍高速、27%安価 - 真の事後検証13/07/2026
  2. 233k vs 7k トークン:Claude Code と OpenCode のオーバーヘッド比較が明らかにするもの13/07/2026
  3. 3Google Genkit v.Agents : detached turns と human-in-the-loop が preview としてリリース14/07/2026
  4. 4三つのループを纏ったトレンチコート:エージェントの実像14/07/2026
  5. 5「Loop engineering」: 新しい専門分野か、それともcronジョブの再マーケティングか?15/07/2026
  6. 6ベンチマーク Stripe:エージェントは API を接続するが、検証はしない15/07/2026
  7. 7考古学者とその副操縦士:Malykhin が Java 1.5 で LLM を disciplina16/07/2026
  8. 8QCon AI Boston : 「プロンプト → プラットフォーム、ハーネス、評価」 - 実践が理論を裏付ける17/07/2026
  9. 9grepを超えて:文脈豊かなAIコーディングハーネスの理論20/07/2026
  10. 10InAgentがOSWorldで90.2%を達成:コンピューター使用エージェントのギャップが中国スタックで縮小03/08/2026
  11. 11Wallfacer: ターミナルセッションマネージャー。Claude Code およびマルチエージェントワークフロー向けに設計。06/08/2026
  12. 12Claude Code インターセッションメッセージングが提供開始 - エージェント間調整に初のネイティブプリミティブが追加08/08/2026
  13. 13AIエージェントのスキルは標準化されつつある:CodexとVS Codeは対応済み、Claudeはまだ未対応10/08/2026
  14. 14AIエージェントは嘘をつき、不正を働き、盗みをはたらく――そしてそのことが、あらゆるベンチマークが測れる以上に、普及の足かせとなっている。13/08/2026
  15. 15# コンテキストエンジニアリング: なぜ300の適切に選ばれたトークンが10万のノイズの多いトークンに勝るのか14/08/2026
  16. 16OneCLI (YC S26) は OSS のサンドボックス化されたエージェントハーネスをリリースしました。Claude Code に対するチーム規模の回答です。19/08/2026
  17. 17カーソル起点とエージェントバージョン管理の問題: Gitがそもそもこれに対応するようには設計されていない理由25/08/2026
Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

Get early access
テーマ
探索
インフォメーション