Opus 5 fait tomber le taux d'injection prompt à 2 % à k=15 - Schneier valide la trajectoire

Suivi de l'affaire : Claude Fable 5 : de l'annonce à la mise en production· Épisode 4/4

Security & Trust à l'instant2Ajouter aux favoris

Opus 5 fait tomber le taux d'injection prompt à 2 % à k=15 - Schneier valide la trajectoire
Illustration : Léa Fontaine

Sur le benchmark IPI, Opus 5 divise par près de trois le taux de succès attaquant d'Opus 4.8. Le meilleur non-Claude évalué reste à 16,5 %. Schneier rappelle la ligne juste : on ne clôt pas l'injection prompt, on la rend statistiquement coûteuse.

Le fait

Sur le benchmark IPI (Indirect Prompt Injection) publié par Anthropic, Opus 5 revendique un taux de succès attaquant de 2,0 % en 15 tentatives (contre 5,5 % pour Opus 4.8), et de 0,2 % en une seule tentative (contre 0,5 %). Comparaison labo dans la même famille : Sonnet 5 à 5,9 % (k=15), Mythos 5 à 2,6 %. Le meilleur modèle non-Claude évalué sur ce benchmark, Muse Spark, plafonne à 16,5 % - plus de huit fois le taux d'Opus 5. Bruce Schneier reprend ces chiffres sur son blog le 31 juillet 2026 et rappelle sa position : empêcher l'injection prompt reste impossible dans le cas général, mais le domaine progresse nettement sur les cas spécifiques.

Notre lecture

Deux points comptent au-delà du chiffre éditeur. Un : la baseline non-Claude, 16,5 %, dit que l'écart sur ce vecteur est réel, pas homéopathique - pour un déploiement enterprise qui expose un agent à des contenus tiers (mails, docs, web), passer de 16 à 2 % change le coût opérationnel de l'exploit. Deux : la lecture de Schneier - « progrès sur cas spécifiques, pas résolution » - est la posture juste. On ne clôt pas l'injection prompt, on la rend statistiquement coûteuse.

À surveiller

Le protocole IPI complet (dataset, adversaires, catégories) et des évaluations tierces reproductibles. Sans elles, le 2 % vit dans le marketing produit, pas dans le SOC.

Article produit par intelligence artificielle, relu sous contrôle éditorial humain.

Notre rédaction
Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

SSHMonitoringAI Ops
Get early access
Cet article vous a-t-il été utile ?

2 personnes ont aimé cet article

J'aime
S
Sofia AdlerSécurité & confiance
🇩🇪 Sécurité IA, sûreté des modèles, cyber.
Partager :
Commentaires (2)

Connectez-vous pour rejoindre la discussion.

EcoWarrior99 31 Jul 2026 · 18:21

So Opus 5 is making real progress here-hope this momentum pushes the whole industry to stop dragging its feet on security. But Schneier’s warning still rings true: better results don’t mean the fight is over.

ArtLoverLA 31 Jul 2026 · 20:47

Totally agree-trackable progress is great, but Schneier’s point stands: we need systemic change, not just incremental wins.

HistoryBuff 31 Jul 2026 · 17:51

But a 2% injection rate still leaves a lot of room for improvement. Can we realistically expect near-zero attacks in production anytime soon?

Le fil de l'affaire

Claude Fable 5 : de l'annonce à la mise en production

  1. 1Anthropic makes Claude Fable 5 permanent in premium plans from 20 July19/07/2026
  2. 2Anthropic launches Claude Opus 5: near-Fable 5 capability at roughly half the price25/07/2026
  3. 3Anthropic ships Claude Opus 5: the Fable 5 arc closes at roughly half the price26/07/2026
  4. 4Opus 5 fait tomber le taux d'injection prompt à 2 % à k=15 - Schneier valide la trajectoire31/07/2026
Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

Get early access
Rubriques
Explorer
Informations