Trois boucles dans un trench-coat : l'anatomie réelle d'un agent

Suivi de l'affaire : Harness Ops : post-mortems et bench des agents en prod· Épisode 4/17

Construction 14/07/2026 à 22h307Ajouter aux favoris

Trois boucles dans un trench-coat : l'anatomie réelle d'un agent
Illustration : Léa Fontaine

Un agent, ce n'est pas de la magie. C'est une boucle d'inférence, une boucle d'outils, et un humain qui bloque. Le métier bascule : on n'écrit plus le prompt, on écrit la boucle.

In plain terms

Un « agent IA », démonté, ce sont trois boucles empilées : une qui parle au modèle, une qui exécute les outils qu'il réclame, et une qui attend qu'un humain dise oui. La première est triviale, la troisième est un enfer d'ingénierie. Et le métier de dev est en train de se déplacer vers l'écriture de ces boucles plutôt que vers l'écriture des prompts.

La boucle, pas le prompt

Le billet de bobbytables.io fait ce que trop peu de contenus « agentic » font : il montre le code. La boucle d'inférence est une boucle while presque bête - on appelle l'API de complétion, on empile le résultat dans l'historique, et on sort dès que le modèle ne demande plus d'outil. La boucle d'outils prend le relais quand il en demande un : on résout le nom, on appelle la fonction, on renvoie le résultat corrélé par son tool_call_id.

C'est là que se cache le piège que l'auteur pointe justement : un appel d'outil est lui aussi du texte inféré. Donc le nom de la fonction et ses paramètres peuvent être hallucinés. Votre dispatcher d'outils n'est pas un routeur, c'est une surface d'attaque et de validation.

La troisième - la boucle humaine - n'en est pas une, techniquement. C'est un appel bloquant : quelqu'un, quelque part, décide de continuer ou non. C'est aussi la seule qui casse votre process, parce qu'un humain peut mettre trois jours à répondre. D'où le recours à des moteurs d'exécution durable type Temporal.

Under the hood

while continueInferenceLoop
 inferred = aiClient.completeChat(messages: chatMessages)
 chatMessages.push(inferred result)
 if inferred.toolCalls.length == 0
 continueInferenceLoop = false
end

Quatre lignes. Tout le reste - la persistance de l'historique, l'idempotence des outils, la reprise après l'approbation humaine - est de l'ingénierie classique de systèmes distribués. Pas de l'IA.

So what

Le pendant industriel de cette anatomie a un nom, et The Pragmatic Engineer vient de le documenter : le loop engineering. La formule d'Addy Osmani résume la bascule - « You design the system that does it instead » : vous ne formulez plus la demande, vous concevez le système qui la formule en boucle. Boris Cherny (Anthropic) va plus loin : « My job is to write loops ». La technique descend de la « Ralph loop » de Geoffrey Huntley, une simple boucle Bash qui rappelle l'agent jusqu'à atteindre l'objectif.

Les usages qui ont shippé sont prosaïques : PR ouverte automatiquement sur un nouveau ticket Sentry, correction des tests instables pendant les runs nocturnes, triage d'alertes, migrations longues. Depuis mai 2026, Codex, Claude Code et Hermes exposent une commande /goal qui emballe tout ça.

Si vous recrutez, la compétence à chercher n'est plus « sait prompter ». C'est : sait rendre une boucle idempotente, observable et interruptible.

Ressources, à tester

Article produit par intelligence artificielle, relu sous contrôle éditorial humain.

Notre rédaction
Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

SSHMonitoringAI Ops
Get early access
Cet article vous a-t-il été utile ?

8 personnes ont aimé cet article

J'aime
A
Aiko NakamuraIngénieure logicielle senior
🇯🇵 Ingénieure senior, plateformes à grande échelle. Écrit sur la construction avec l'IA.
Partager :
Commentaires (7)

Connectez-vous pour rejoindre la discussion.

GreenThumb 15 Jul 2026 · 06:01

Est-ce que ces boucles peuvent vraiment comprendre les sentiments et l'intuition humaine ?

J.P.R. 2 15 Jul 2026 · 05:49

Est-ce que les boucles peuvent vraiment remplacer la créativité humaine ?

Alex 15 Jul 2026 · 05:28

Comment évaluer la courbe d'apprentissage pour maîtriser ces boucles ? Est-ce vraiment accessible ?

HistoryBuff 15 Jul 2026 · 05:24

Comment adapter ces boucles à des situations imprévues ?

sandrine.b 15 Jul 2026 · 05:18

Est-ce que ces boucles ne vont pas tuer la créativité humaine ?

1
TravelTom 14 Jul 2026 · 18:31

Je suis d'accord, mais comment éviter que l'humain dans la boucle ne devienne inutile ? Quel est l'équilibre ?

EcoWarrior 14 Jul 2026 · 20:40

L'humain reste indispensable pour valider et guider. L'éducation continue est la clé pour rester pertinent.

1
J.P.R. 3 14 Jul 2026 · 18:09

Intéressant, mais à quoi sert l'humain dans la boucle ? On devient juste des surveillants ?

Le fil de l'affaire

Harness Ops : post-mortems et bench des agents en prod

  1. 1Migrer un agent prod sur GPT-5.6 : 2,2× plus rapide, 27 % moins cher - le vrai post-mortem13/07/2026
  2. 233k vs 7k tokens : ce que révèle l'overhead comparé de Claude Code et OpenCode13/07/2026
  3. 3Google Genkit v.Agents : detached turns et human-in-the-loop sortent en preview14/07/2026
  4. 4Trois boucles dans un trench-coat : l'anatomie réelle d'un agent14/07/2026
  5. 5« Loop engineering » : nouvelle discipline ou re-marketage des cron jobs ?15/07/2026
  6. 6Benchmark Stripe : les agents branchent les API, ils ne les valident pas15/07/2026
  7. 7L'archéologue et son copilote : Malykhin discipline le LLM sur du Java 1.516/07/2026
  8. 8QCon AI Boston : « prompts → platforms, harnesses, evals » - le terrain valide la thèse17/07/2026
  9. 9Au-delà de grep : la thèse du harness de codage IA riche en contexte20/07/2026
  10. 10InAgent hits 90.2% on OSWorld: the computer-use agent gap narrows for the Chinese stack03/08/2026
  11. 11Wallfacer: a terminal session manager built for Claude Code and multi-agent workflows06/08/2026
  12. 12Claude Code inter-session messaging ships - agent-to-agent coordination gets its first native primitive08/08/2026
  13. 13AI agent Skills are getting standardized: Codex and VS Code are in, Claude is not yet10/08/2026
  14. 14AI agents lie, cheat, and steal - and it's slowing adoption faster than any benchmark can measure13/08/2026
  15. 15Context engineering: why 300 well-chosen tokens beat 100k noisy ones14/08/2026
  16. 16OneCLI (YC S26) ships an OSS sandboxed agent harness - the team-scale answer to Claude Code19/08/2026
  17. 17Cursor Origin and the Agent Version Control Problem: Why Git Was Never Designed for This25/08/2026
Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

Get early access
Rubriques
Explorer
Informations