$ skip to content
IA70%
update

Opus 5 élimine l'injection prompt sur navigateur

Anthropic annonce que Opus 5 associé à Auto Mode atteint un taux d'injection prompt de 0% sur 129 scénarios de test impliquant des agents navigateur. Le même modèle sans couches de protection suppléme

Opus 5 élimine l'injection prompt sur navigateur
// illustration générée — IA7
0:00 / 0:00
/

Cette progression change les termes du déploiement en production. Les agents navigateur peuvent désormais interroger du contenu non fiable (pages web publiques, formulaires utilisateur) sans risquer que leurs objectifs se détournent. La combinaison modèle + architecture semble clore une faille que les équipes dev contournaient par sandbox ou filtrage manuel.

La limite reste la réplication en environnement réel. Les tests Anthropic couvrent 129 cas de figure, mais Internet en génère de nouvelles chaque jour. Les équipes déployant Opus 5 en production rapporteront rapidement si ces chiffres se maintiennent face à des adversaires réels.

Le verrouillage de cette surface d'attaque libère des ressources de sécurité pour d'autres problèmes : hallucinations, délégations non-autorisées, exfiltration de contexte.

// à savoir

Injection prompt

Attaque où du contenu web non-contrôlé modifie les instructions cachées d'un agent IA, détournant son objectif initial.

Agent navigateur

IA capable de lire, cliquer et remplir des formulaires sur des pages web pour accomplir des tâches sans intervention humaine.

Auto Mode

Régime d'exécution Anthropic où Claude opère des agents sans approbation humaine entre chaque action.
source
/ feed ↩