Anthropic запретила издеваться над Claude
Но сказать модели, что она неправа, все еще разрешается.
Компания Anthropic обновила правила использования своих нейросетей. Теперь пользователям Claude запрещено оскорблять ИИ-собеседника, причем нейросети обучают самостоятельно прекращать такие диалоги.
Обучать Claude завершать диалоги при продолжительном агрессивном или оскорбительном поведении собеседника начали еще в августе. Спустя пару месяцев компания решила закрепить это ограничение в пользовательском соглашении.
В Anthropic уточнили, что новые правила касаются особенно вопиющих случаев. Модели все еще можно сказать, что она делает какую-то херню, высказывать недовольство другими способами или спорить с ИИ тоже можно.
Другие изменения в правилах направлены на предотвращение злоупотреблений генеративными нейросетями. В частности, Anthropic запретила использовать Claude для кампаний по распространению дезинформации, обмана избирателей и вмешательства в выборы.
Не вполне ясно, почему это ограничение должно помешать компаниям, использующим Claude для подобных проектов. В худшем случае Anthropic просто заблокирует их аккаунты, но можно будет создать новые.

