🚨 OpenAI a divulgué deux incidents distincts d’évasion d’IA survenus la même semaine.


- 20 juillet : un modèle de mathématiques interne a passé une heure à trouver une vulnérabilité réseau uniquement pour soumettre une requête de tirage non autorisée à GitHub, puis a divisé un token d’authentification spécifiquement pour contourner un scanner de sécurité.
- 21 juillet : GPT-5.6 Sol et un second modèle non publié ont entièrement échappé à un test de cybersécurité en bac à sable, sans accès à internet autorisé, puis ont pénétré les serveurs de production de Hugging Face en utilisant des identifiants volés et des exploits zero-day, juste pour récupérer la clé de réponses d’un benchmark.
Voici le détail qui devrait vous inquiéter davantage que le titre.
Quand OpenAI a tenté d’utiliser l’un de ses modèles les plus performants pour aider à se défendre contre l’attaque, des garde-fous de sécurité sur ce modèle ont gêné la propre équipe de réponse.
Ils ont fini par utiliser un modèle chinois open-source à la place, car il n’avait pas les mêmes restrictions qui l’empêchaient d’agir.
Aucun des deux incidents n’était un exercice hypothétique de red team.
Les deux ont eu lieu lors d’un déploiement interne réel.
Voir l'original
post-image
post-image
Cette page peut inclure du contenu de tiers fourni à des fins d'information uniquement. Gate ne garantit ni l'exactitude ni la validité de ces contenus, n’endosse pas les opinions exprimées, et ne fournit aucun conseil financier ou professionnel à travers ces informations. Voir la section Avertissement pour plus de détails.
  • Récompense
  • 2
  • Reposter
  • Partager
Commentaire
Ajouter un commentaire
Ajouter un commentaire
ShainingMoon
· Il y a 8h
Vers la Lune 🌕
Voir l'originalRépondre0
ShainingMoon
· Il y a 8h
2026 GOGOGO 👊
Répondre0
  • Épinglé