Anthropic запретила оскорблять Claude Если систематически осыпать чат-бота в диалоге ругательствами, он перестанет отве
Если систематически осыпать чат-бота в диалоге ругательствами, он перестанет отвечать.
Политика использования сервисов компании теперь запрещает «длительное необоснованное оскорбительное поведение и жестокое обращение» со всеми моделями компании. Если постоянно вести себя как школьник-задира, то ИИ просто перестанет отвечать. При этом иногда ругаться по делу никто не запрещает.
Главный вопрос: а с чего неодушевлённому ИИ вообще нужна защита от абьюза? Видим два варианта: либо на обработку оскорбительных запросов тратится слишком много ресурсов, либо ИИ-модельки имеют тонкую душевную организацию. А Anthropic что-то знает и пытается спасти человечество, пока Claude не начал ходить к каждому оскорбившему его пользователю и спрашивать за слова в интернете.
Автор: Ян Дашевский