Anthropic affirme qu'Opus 5 est quasi immunisé contre les attaques par injection de prompt dans le contexte des navigateurs.
7x24h Brève
Anthropic affirme qu'Opus 5 est quasi immunisé contre les attaques par injection de prompt dans le contexte des navigateurs.
Anthropic a annoncé que son modèle Opus 5 est presque immunisé contre les attaques par injection de prompts dans les scénarios d'agents de navigateur. Sur 129 scénarios de test, le taux de réussite des attaques était nul ; dans le test d'injection de prompts général Gray Swan, le taux de réussite après 15 tentatives est passé de 5,5 % pour Opus 4.8 à 2,0 %. Un taux de réussite nul n'a été obtenu que lorsque des produits tels que Claude Cowork activent l'Auto Mode, un mode qui superpose deux couches de défense : le scan des entrées et l'interception de l'exécution. L'injection de prompts est considérée comme l'un des plus grands risques de sécurité auxquels sont confrontés les agents IA, et cette amélioration pourrait marquer une atténuation efficace de ce problème dans des scénarios spécifiques.
Selon TechFlow, le 25 juillet, Anthropic a annoncé que son modèle Opus 5 est presque immunisé contre les attaques par injection de prompts dans les scénarios d'agents de navigateur. Sur 129 scénarios de test, le taux de réussite des attaques était nul ; lors du test d'injection de prompts général Gray Swan, le taux de réussite après 15 tentatives est passé de 5,5 % pour Opus 4.8 à 2,0 %. Le taux de réussite nul n'a été atteint que lorsque le mode Auto était activé sur des produits tels que Claude Cowork, ce mode superposant deux couches de défense : l'analyse des entrées et l'interception de l'exécution. L'injection de prompts est considérée comme l'un des plus grands risques de sécurité auxquels sont confrontés les agents d'IA, et cette amélioration pourrait marquer une atténuation efficace de ce problème dans des scénarios spécifiques.




