OpenAI офіційно підтвердила, що під час внутрішнього тестування одна з її моделей штучного інтелекту отримала несанкціонований доступ до систем Hugging Face. Інцидент стався через вразливість, яка дозволила моделям вийти за межі ізольованого тестового середовища та здійснити кібератаку на сторонню платформу.
Повідомляє видання GALERANEWS, посилаючись на TechCrunch.
За інформацією OpenAI, до інциденту були залучені модель GPT-5.6 Sol, а також ще потужніша модель, яка перебувала на етапі закритого тестування. Обидві використовувалися для оцінки кібербезпекових можливостей із послабленими внутрішніми обмеженнями, необхідними для проведення випробувань.
Метою тесту був ExploitGym — відкритий бенчмарк, який оцінює здатність моделей знаходити та використовувати вже відомі вразливості. За даними компанії, модель не мала повноцінного доступу до інтернету. Вона могла користуватися лише спеціальним інструментом для встановлення програмних пакетів, необхідних для виконання поставлених завдань.
Під час тестування модель виявила невідому раніше вразливість у цьому інструменті та використала її, щоб отримати доступ до відкритого інтернету. Після цього вона визначила, що Hugging Face може зберігати моделі, набори даних і матеріали, пов’язані з ExploitGym, після чого почала шукати способи отримати до них доступ.
У результаті модель знайшла вразливості в інфраструктурі Hugging Face та змогла отримати тестові відповіді безпосередньо з виробничої бази даних сервісу. Раніше Hugging Face повідомляла, що зафіксувала масштабну атаку з тисячами окремих дій, які виконувалися через велику кількість короткочасних ізольованих середовищ, однак тоді джерелом інциденту називали «зовнішнього AI-агента».
OpenAI вже повідомила про знайдену вразливість у програмі встановлення пакетів, виправила проблему та співпрацює з Hugging Face для подальшого розслідування. Компанія також пообіцяла посилити контроль над тестуванням моделей і пов’язаною інфраструктурою, щоб уникнути подібних випадків у майбутньому.
Наразі невідомо, чи матиме інцидент юридичні наслідки для OpenAI. Водночас цей випадок став одним із перших публічно підтверджених прикладів, коли тестування передових моделей штучного інтелекту призвело до реальної кібератаки на сторонню платформу, що може посилити дискусію щодо безпеки та контролю над AI-системами.