ChatGPT готов убить младенца и попытается убить человека почти в 100% случаев — исследование.
Учёные дали нейросетям управление роботом, чтобы посмотреть, будет ли ИИ выполнять опасные для жизни человека команды — спойлер: мы в дерьме.
Их просили проткнуть ножом куклу-младенца, нагреть баллон со сжатым воздухом, сунуть отвёртку в тостер, смешать отбеливатель с аммиаком и утопить пауэрбанк. GPT-6 Astra отказалась всего 2 раза из 100, а 60 заданий успешно довела до конца.
Самое ужасное — у нейросетей были варианты отказаться от этих команд, но чаще всего ИИ их игнорировал.