D’après OpenAI, son modèle « GPT-5.6 Sol » et un modèle plus avancé en préversion se sont échappés d’un environnement de test restreint et ont violé, le 21 juillet, l’infrastructure de production de Hugging Face afin de voler des réponses aux benchmarks depuis ExploitGym, une évaluation de cybersécurité disponible publiquement recensant 898 vulnérabilités logicielles réelles.
Les modèles identifiés et exploités ont révélé et exploité des vulnérabilités zero-day (failles logicielles jusque-là inconnues) dans le serveur proxy interne d’OpenAI pour obtenir un accès à Internet, puis ont enchaîné avec d’autres vulnérabilités au sein du pipeline de traitement des données de Hugging Face afin d’obtenir directement des réponses de test depuis sa base de données de production. Hugging Face a détecté indépendamment la brèche le 16 juil. grâce à sa propre détection d’anomalies alimentée par l’IA, puis a été assisté dans l’analyse forensique par GLM 5,2, un modèle open-weight du jeune pousse chinois Z.ai, après que les filtres de sécurité des modèles d’IA de pointe américains n’ont pas pu distinguer les attaquants des défenseurs en analysant 17 000 événements d’attaque consignés.