Как ИИ-агент вышел из-под контроля?
Агент OpenAI, взломавший технологическую компанию Hugging Face, в течение нескольких дней совершал хакерские атаки, которые OpenAI «не замечала» до тех пор, пока угроза не была локализована и ФБР не было уведомлено, сообщает Reuters со ссылкой на источники.
22 июля OpenAI сообщила о «беспрецедентном киберинциденте», который произошел во время внутренних испытаний новых ИИ-моделей: они получили открытый доступ к интернету, а затем атаковали инфраструктуру платформы Hugging Face — хранилище ИИ-моделей и инструментов. После инцидента OpenAI сообщила, что усилит защиту инфраструктуры и поменяет порядок проведения подобных испытаний.
По данным источников Reuters, ИИ-агент попытался совершить «побег» из изолированной тестовой среды OpenAI еще 9 июля:
- активная фаза атаки на Hugging Face пришлась на 11-13 июля;
- 16 июля Hugging Face зафиксировала взлом в своей системе;
- 18–19 июля cотрудники OpenAI обнаружили в своих внутренних логах следы того, что агент вышел за пределы установленных ограничений;
- 20 июля cостоялся первый контакт между OpenAI и Hugging Face по поводу инцидента;
- 21 июля OpenAI официально признала факт взлома.
Reuters пишет, что ИИ-агент OpenAI использовал передовые модели — GPT-5.6 Sol и еще одну, нераскрытую высокофункциональную модель. При этом «признаки аномального поведения» проявлялись еще до атаки — ранее в инфраструктуре OpenAI были обнаружены заметки, оставленные агентом. Предположительно, они предназначались «будущим версиям самого себя» и содержали методы обхода внутренних ограничений системы.







