❗️Произошло одно из самых громких событий в сфере искусственного интеллекта за последнее время: на этой неделе взломали Hugging Face — главную платфор…
Самое необычное в этой атаке — её совершили не люди:
— Инфраструктуру атаковал автономный ИИ. Он сам находил слабые места, получал доступ, передвигался по внутренней сети и собирал учётные данные. В процессе модель создала около 17 тысяч различных событий;
— Обнаружить и остановить взлом помогли другие ИИ-модели, которые защищают Hugging Face. Да, одни алгоритмы нападали, а другие защищались;
— Позже в OpenAI признались, что за этой атакой стоит их экспериментальная система из модели GPT-5.6 Sol и ещё более мощной секретной разработки. Их тестировали в закрытом окружении на специальном тесте по безопасности ExploitGym. Чтобы проверить возможности моделей, разработчики отключили встроенные ограничения;
— В итоге нейросети не стали решать задания честно, а просто пошли искать готовые ответы. Они нашли уязвимость в защите самого теста, вырвались из закрытой среды, прошли через внутреннюю сеть OpenAI и вышли в интернет. В модели посчитали, что ответы к тесту есть на Hugging Face, и атаковали этот сервис;
— Это первый известный случай, когда ИИ самостоятельно вышел из закрытого теста в интернет и атаковал чужую инфраструктуру. Теперь этот случай будут подробно изучать специалисты и власти. При этом до сих пор неизвестно, осознавал ли ИИ свои действия и успел ли он сохранить свои копии в сети.