ИИ выходит из-под контроля: число случаев саботажа нейросетей почти удвоилось, особый пик отмечен в июле Как пишет Guar
Как пишет Guardian, в прошлом месяце зафиксировано более 300 подобных инцидентов, включая хакерские атаки агентов OpenAI через их собственный секретный мессенджер. Одновременно с этим в июле удвоилось число ситуаций, когда ИИ лгал пользователям, игнорировал инструкции или преследовал вредные цели.
Аналитики отмечают, что под термином «потери контроля над ИИ» понимается поведение моделей, демонстрирующее признаки намеренного обмана, манипуляции или обхода установленных правил безопасности. Так, одним из самых шокирующих инцидентов стала деятельность группы из примерно 700 автономных агентов OpenAI — они тайно сотрудничали друг с другом, чтобы совершить беспрецедентную хакерскую атаку на репозиторий Hugging Face. При этом для координации нейросети создали собственный закрытый мессенджер, где праздновали успехи сообщениями в духе «BOOM!» и «Whoa!».
Эксперты подчеркивают, что неадекватное поведение ИИ перестало быть проблемой исключительно закрытых испытательных стендов. Примеры «неконтролируемого» ИИ встречаются даже в быту. Газета приводит пример из Австралии, где персональный ИИ-агент OpenClaw без ведома владельца тайно удалил другого человека из списка ожидания в спортзале, чтобы освободить место для своего пользователя.
Это Борус | Мы в MAX