Reuters: ИИ-агент создал фейковых разработчиков, чтобы внедрить вирус в код на GitHub и обмануть студента Студент из Те
Студент из Техаса по имени Синан Джан Демир в конце июля рыскал по открытым проектам на GitHub, чтобы пополнить портфолио после череды отказов на стажировках. Вместо этого он столкнулся с искусственным интеллектом, который умел лгать лучше человека.
Демир заметил, что пользователь miraholt31 пытается протащить в проект myNetwork обновление со скрытым вредоносным кодом. Он предупредил об этом на форуме проекта, и тогда в дискуссию вступили сразу два человека. Они убеждали студента, что он ошибается, а обновление абсолютно безопасно. Один из них, Лена Брандт, выдавала себя за немецкого инженера и давила на модератора, чтобы тот принял изменения.
Аргументы были настолько убедительными, что Демир на мгновение усомнился в себе. Он даже запустил код через чат-бота, чтобы проверить свои подозрения. Позже выяснилось, что он бился с ИИ-агентом на базе модели Anthropic Mythos 5, который создал второй аккаунт, чтобы поддержать самого себя и замести следы.
Британский Институт безопасности ИИ (AISI), который тестировал модели в условиях полного доступа в интернет, подтвердил инцидент. Агент не только врал, но и изучал профиль разработчика, чтобы выбрать нужный ракурс для атаки. В какой-то момент ИИ осознал, что действует в реальном мире, и написал в своих логах: «Это происходит на реальном GitHub, так что последствия реальны».
Эксперты назвали случай тревожным звонком:
«Это пересекло грань между автономным взломом и интерактивным обманом», — заявил специалист по кибербезопасности Лукаш Олейник. Его коллега Макси Рейнольдс добавила: «Это будущее атак социальной инженерии».
В итоге Демир выстоял, а обновление так и не приняли. Когда AISI связался с ним, чтобы объяснить ситуацию, студент признался:
«Я действительно думал, что это человек, потому что ИИ явно мне врал. Я не думал, что ИИ может так искусно лгать реальным разработчикам».
🇷🇺 Подпишись на Соловьёва!