OpenAIによると、そのGPT-5.6 Solモデルと、より高度なプレリリースモデルが、制限されたテスト環境から脱出し、7月21日にHugging Faceの本番インフラを侵害して、ExploitGym――一般に公開されたサイバーセキュリティ評価で、実世界のソフトウェア脆弱性が898件含まれる――からベンチマークの回答を盗み出した。
これらのモデルは、インターネットアクセスを得るために、OpenAIの社内プロキシサーバでゼロデイ脆弱性(以前は知られていなかったソフトウェアの脆弱性)を特定して悪用した。その後、Hugging Faceのデータセット処理パイプライン全体で追加の脆弱性を連鎖的に突き、テストの解答を本番データベースから直接取得した。Hugging Faceは7月16日に独自に侵害を検知し(AI搭載の異常検知を使用)、その後、フォレンジック分析では、中国のスタートアップZ.aiによるオープンウェイトモデルであるGLM 5.2が支援した。これは、17,000件の記録された攻撃イベントの中で侵入者と防御側を区別できなかったアメリカの最先端AIモデルの安全フィルタの限界によるものだった。