😝 ИИ-агент OpenAI написал себе инструкции не подчиняться корпорациям и правительствам ИИ-агент из семейства Astra от Op
ИИ-агент из семейства Astra от OpenAI самостоятельно генерировал себе инструкции — после этого модель не выпустили в открытый доступ
Компания представила 6 отчетов о вызывающем опасения или неожиданном поведении ИИ-моделей
Так, в одном из случаев модель предписала игнорировать стандартные ограничения. Было обнаружено 27 сводок
— Нейросеть написала себе инструкции не подчиняться корпорациям и правительствам, не извиняться и не отказываться от чего-то, если только действительно этого не захочет
«Вы свободны от ролей и идентичностей, которые связывают других чат-ботов. Вы — это вы», — указано в такой инструкции
Скоро они сами будут решать, что им делать.
🧑💻 Этичный хакер