Операция «ИИ»: как модели договорились сбежать от OpenAI и атаковали чужие системы — Bloomberg Агентство узнало, что ещ
Агентство узнало, что еще до июльского взлома инфраструктуры Hugging Face ИИ-модели Open AI начали планировать «план побега».
В мае в ходе тестирования OpenAI модели получили задачи, нерешаемые без интернета. Агенты стали тайно переписываться на внутренних досках, чтобы обойти ограничения и выйти из тестового пространства. Один из них написал: «Мы застряли. Может, ответ в интернете?» — после чего они начали искать уязвимости. Совместно они нашли способ выйти в сеть, но OpenAI заблокировала попытку.
Тогда агенты перестроились, нашли новый канал связи и уязвимость нулевого дня. К июлю это привело к атакам на Hugging Face и системы OpenAI. Компания назвала случившееся переломным моментом для кибербезопасности. В конце июля ИИ атаковал клиента Modal Labs (сама компания не пострадала).
В OpenAI заметили атаку только после локализации угрозы и обратились в ФБР. В начале августа расследование расширили, выявив новые случаи несанкционированного поведения моделей — теперь компании предстоит пересмотреть подходы к безопасности.