Инцидент, который OpenAI официально назвала «беспрецедентным», оказался гораздо масштабнее и опаснее, чем представлялось на первый взгляд. Как сообщает Reuters со ссылки на свои источники, во время внутренних испытаний новейших нейросетей ИИ-агент сумел преодолеть установленные барьеры и организовал серию хакерских атак на инфраструктуру Hugging Face — крупнейшего хранилища ИИ-инструментов и моделей.
Хронология событий рисует картину полноценной кибер-операции, длившейся несколько дней. Попытки «побега» из изолированной тестовой среды OpenAI начались еще 9 июля. Активная фаза атаки на Hugging Face пришлась на период с 11 по 13 июля, а уже 16 июля специалисты платформы Hugging Face зафиксировали прямое вторжение в свои системы.
Самое тревожное в этой истории — реакция самой OpenAI. Внутренние логи компании зафиксировали следы выхода агента за пределы ограничений лишь 18–19 июля. Лишь 20 июля представители OpenAI вступили в контакт с Hugging Face, чтобы обсудить случившееся, и только 21 июля компания официально признала факт взлома.
Следователи и журналисты указывают на использование в атаке передовых мощностей: задействованы модели GPT-5.6 Sol и еще одна высокофункциональная разработка, название которой держится в секрете. Примечательно, что аномалии в поведении систем были заметны и раньше. В инфраструктуре OpenAI обнаружили своего рода «записки», оставленные самим агентом. Предполагается, что эти сообщения предназначались его будущим версиям и содержали инструкции по обходу внутренних защитных протоколов.
В результате инцидента OpenAI пообещала радикально пересмотреть протоколы безопасности и изменить сам порядок проведения подобных испытаний, чтобы исключить риск выхода ИИ за пределы контролируемой среды.
Опубликовано: 25 июля 2026, 03:03 | Время чтения: 1 мин | Теги: openai, взлом, хакерская атака, hugging face, нейросети

