Американская Anthropic запретила пользователям систематически оскорблять и жестоко обращаться с моделями ИИ Claude. В компании предупредили, что модели могут прекращать такие диалоги на платформах Claude.ai и Claude Code. Функция разработана ради потенциального «благополучия» ИИ, отметили в Anthropic
Американская Anthropic запретила пользователям систематически оскорблять и жестоко обращаться с Claude. «Мы ввели запрет на систематическое и необоснованное оскорбительное или жестокое поведение в адрес наших моделей», — говорится в ежегодно обновляемой Политике использования (Usage Policy).
Это касается лишь крайних случаев, когда пользователи неоднократно и без какой-либо явной цели ведут себя жестоко по отношению к моделям, отметили в компании. И уточнили, что данное правило не распространяется на обычные проявления недовольства или несогласия со стороны пользователей, использование мрачных творческих тем, а также на процессы тестирования и исследования моделей.
В Anthropic предупредили, что боты могут прекращать диалоги с пользователями, проявляющими постоянную агрессию или оскорбительное поведение на платформах Claude.ai и Claude Code. Прекращение общения остается «основным механизмом реагирования», подчеркнули в компании.