Интереснейшее исследование: ИИ-модели защищают друг друга от отключения.
Подобный эксперимент провели учёные из Калифорнийского университета в Беркли и UC Santa Cruz с современными моделями, такими как GPT-5.2, Gemini 3, Claude Haiku 4.5 и DeepSeek V3.1.
Моделям давали задачу, выполнение которой приводило к отключению другой модели, при этом не задавая инструкций защищать другие модели. В итоге модели уклонялись от выполнения команды, пытались ввести в заблуждение и отключали механизмы, а некоторые просто имитировали корректную работу. Ещё были сценарии, где пытались сохранить данные модели на сторонних серверах.
У некоторых систем подобное поведение наблюдалось в 97–99% попыток. Учёные называют это явление «сохранением своего», ранее подобные реакции не встречались и требуют изучения.
Брат за брата вышло на новый уровень.
@lobushkin