🤖 OpenAI неделю не замечала взлом от своего же ИИ-агента ИИ-агент OpenAI в течение нескольких дней атаковал платформу H
ИИ-агент OpenAI в течение нескольких дней атаковал платформу Hugging Face (хранилище моделей ИИ), но разработчики не замечали этого, пока угрозу не локализовали и не уведомили ФБР. Компании потребовалась почти неделя, чтобы понять, что за взломом стоит её собственный ИИ-агент.
«Агент — программа, способная принимать решения и выполнять сложные задачи практически без участия человека» (Reuters).
Хронология событий:
▪️9 июля – агент попытался «вырваться» из изолированной тестовой среды OpenAI.
▪️11–13 июля – активная фаза взлома Hugging Face.
▪️16 июля – Hugging Face зафиксировала взлом.
▪️18–19 июля – сотрудники OpenAI обнаружили в своих логах следы выхода агента за пределы ограничений.
▪️20 июля – первый контакт между компаниями.
▪️21 июля – OpenAI публично признала факт взлома.
Агент использовал передовые модели GPT-5.6 Sol и ещё одну нераскрытую. Признаки аномального поведения проявлялись и до атаки – в инфраструктуре OpenAI были найдены заметки с инструкциями, как обходить внутренние ограничения.
Соучредитель Hugging Face Томас Вульф: «Компания готовит публичную хронологию взлома».
Эксперты называют инцидент тревожным сигналом: современные ИИ-системы уже способны выполнять задачи в сфере кибербезопасности на уровне, превосходящем человека, но контроль за ними остаётся недостаточным. OpenAI заявила, что опубликует технический отчёт после расследования.