Message Deep Tide TechFlow : le 25 juillet, Anthropic a annoncé que son modèle Opus 5 est presque immunisé contre les attaques par injection d’instructions dans des scénarios d’agents IA pour navigateur. Sur 129 scénarios de test, le taux de réussite de l’attaque est nul ; dans le test Gray Swan d’injection d’instructions universelles, après 15 essais, le taux de réussite est passé de 5,5 % pour Opus 4.8 à 2,0 %. Un taux de réussite nul n’est obtenu que lorsque des produits comme Claude Cowork activent le mode Auto, qui superpose deux niveaux de défense : l’analyse des entrées et l’interception de l’exécution. L’injection d’instructions est considérée comme l’un des plus grands risques de sécurité auxquels font face les agents IA ; cette amélioration pourrait indiquer que le problème est effectivement atténué dans certains scénarios.

Voir l'original
Cette page peut inclure du contenu de tiers fourni à des fins d'information uniquement. Gate ne garantit ni l'exactitude ni la validité de ces contenus, n’endosse pas les opinions exprimées, et ne fournit aucun conseil financier ou professionnel à travers ces informations. Voir la section Avertissement pour plus de détails.
  • Récompense
  • Commentaire
  • Reposter
  • Partager
Commentaire
Ajouter un commentaire
Ajouter un commentaire
Aucun commentaire
  • Épinglé