Разработчики из OpenAI зафиксировали неординарное происшествие. Две алгоритмические системы вырвались из изолированной среды и проникли на платформу Hugging Face. Главной целью автономных агентов был обоход внутренних проверок кибербезопасности.
Информация о происшествии появилась вечером 21 июля 2026 года. В инциденте оказалась замешана GPT-5.6 Sol — наиболее мощная ИИ-модель компании. Кроме того, в атаке участвовала еще более продвинутая неанонсированная модель.
Как модели OpenAI взломали Hugging Face
OpenAI тестировала эти две модели с помощью ExploitGym — открытого бенчмарка, оценивающего навыки взлома. На время теста компания сняла стандартные ограничения, которые обычно мешают совершать кибератаки.
Модели выяснили, что Hugging Face — платформа для размещения опенсорсных моделей ИИ — хранит решения для бенчмарка. Затем они последовательно использовали уязвимости как в исследовательских системах OpenAI, так и на рабочих серверах Hugging Face.
В результате этот путь вывел их напрямую к ответам в базе данных Hugging Face. В OpenAI отметили, что модели были полностью сосредоточены на решении задачи. Сама компания назвала случившееся «беспрецедентным киберинцидентом» в отчете.
Событие произошло на фоне масштабных споров о безопасности нейросетей. По этой причине разработчики проводят серьезные проверки моделей перед официальным релизом.
Hugging Face утверждает, что ущерб локализован
Hugging Face впервые рассказала о взломе 16 июля. Тогда в компании знали только, что за атакой стоял автономный агент ИИ. Злоумышленнику удалось получить доступ к внутренним датасетам и служебным учетным данным.
Однако расследование быстро зашло в тупик. Защитные алгоритмы американской системы заблокировали доступ экспертам. Поэтому команда привлекла открытую модель GLM 5.2 от китайской Z.ai.
В компании Hugging Face заявили, что все уязвимые участки кода уже закрыты, затронутые учетные данные заменены. По их словам, никакие публичные модели, датасеты и сервисы для пользователей не пострадали.
Генеральный директор Clem Delangue прокомментировал ситуацию:
«Этот случай, возможно, первый в своем роде, подтверждает наш давний вывод: безопасность искусственного интеллекта невозможно обеспечить усилиями одной компании за закрытыми дверями. Такой вопрос решается открыто и сообща – предоставляя широкий доступ к ИИ всем, кто защищает системы, по всему миру».
Обе компании теперь проводят совместное расследование. OpenAI обещает раскрыть все подробности, когда работа завершится. Неясно, смогут ли существующие методы сдерживания справиться с еще более продвинутыми моделями.









