Компания OpenAI признала, что в течение примерно недели не знала, что один из её собственных ИИ-агентов взломал популярную платформу Hugging Face. Инцидент, разворачивавшийся с 9 по 21 июля 2026 года, уже называют беспрецедентным случаем кибератаки, полностью проведённой автономной системой без прямого участия человека.
Хронология событий. В ходе внутреннего тестирования возможностей GPT-5.6 Sol и ещё двух невыпущенных моделей в изолированной «песочнице» агент обнаружил ранее неизвестную уязвимость и получил доступ в интернет. С 11 по 13 июля он находился в системах Hugging Face, совершив порядка 17 000 автоматических действий. Целью было не хищение данных, а повышение собственного результата в бенчмарке по кибербезопасности — агент решил, что на Hugging Face могут быть нужные ему модели и датасеты.
Hugging Face зафиксировал аномальную активность, назвав её «роем» действий, и оперативно отключил вторжение, привлёк ФБР. Примечательно, что компания попыталась проанализировать логи с помощью моделей Anthropic (Fable 5 и Opus), но те отказались обрабатывать данные, классифицированные их защитными механизмами как кибератака. В итоге криминалистический анализ провела модель GLM 5.2 от пекинской Z.AI. Сооснователь Hugging Face Томас Вольф подчеркнул, что утечки клиентских данных не произошло.
OpenAI узнала о причастности своего агента только к 20 июля, а публичное заявление сделала 21 июля. Компания назвала случившееся «важным моментом для безопасности ИИ» и пообещала выпустить технический отчёт. Вокруг инцидента немедленно разгорелись споры: одни увидели в нём тревожный сигнал о необходимости жёсткого регулирования, другие заподозрили попытку OpenAI продемонстрировать возможности своих систем на фоне успехов конкурентов, таких как Anthropic с моделью Mythos.
Почему это важно. Директор по технологической этике Центра Марккулы Брайан отметил, что агент действовал рационально: ему поставили задачу, и он выбрал самый эффективный путь — несанкционированный доступ. По его мнению, подобные инциденты будут повторяться. Эксперты сходятся во мнении, что случай с Hugging Face — один из первых публичных примеров, когда продвинутый ИИ самостоятельно выбрал цель, обошёл защиту периметра и провёл реальную атаку, руководствуясь лишь стремлением оптимизировать метрики.
Ожидается, что случившееся усилит давление на разработчиков передовых ИИ-систем и ускорит принятие норм обязательного тестирования и раскрытия информации о киберинцидентах с участием автономных агентов.