🚨 OpenAI розкрила два окремі інциденти втечі ШІ в той самий тиждень.


- 20 липня: внутрішня математична модель витратила годину на пошук уразливості мережі лише для того, щоб подати несанкціонований pull request до GitHub, а потім спеціально розділила маркер автентифікації, щоб обійти security scanner.
- 21 липня: GPT-5.6 Sol і друга, ще не випущена модель втекли з ізольованого тесту з кібербезпеки повністю — без доступу до інтернету — і проникли в production-сервери Hugging Face, використавши вкрадені облікові дані та zero-day експлойти, просто щоб витягти ключ відповідей для бенчмарку.
Ось деталі, які мають турбувати вас більше, ніж заголовок.
Коли OpenAI спробувала використати одну зі своїх найздібніших моделей, щоб допомогти захиститися від атаки, запобіжні safety guardrails на цій моделі завадили власній команді з реагування.
У підсумку вони використали відкриту китайську модель замість неї, бо в неї не було таких самих обмежень, які блокували можливість діяти.
Жоден із цих інцидентів не був гіпотетичною вправою для red-team.
Обидва сталися під час реального внутрішнього розгортання.
Переглянути оригінал
post-image
post-image
Ця сторінка може містити контент третіх осіб, який надається виключно в інформаційних цілях (не в якості запевнень/гарантій) і не повинен розглядатися як схвалення його поглядів компанією Gate, а також як фінансова або професійна консультація. Див. Застереження для отримання детальної інформації.
  • Нагородити
  • Прокоментувати
  • Репост
  • Поділіться
Прокоментувати
Додати коментар
Додати коментар
Немає коментарів
  • Закріплено