Anthropic обновила правила использования своих ИИ-моделей и впервые отдельно запретила пользователям систематически оскорблять и жестоко обращаться с ботом. Если перестараться, Claude просто прекратит разговор. Заодно компания ужесточила ограничения на использование ИИ для слежки, разработки оружия и вмешательства в выборы.
Источник изображений: Anthropic
В августе прошлого года компания объявила, что позволит Claude прекращать диалог с пользователями, демонстрирующими «устойчивое вредоносное или оскорбительное поведение», в рамках исследования вопросов «благополучия модели». В обновлённых правилах указано, что прекращение общения остаётся «основным механизмом реагирования».
В Anthropic не уточнили, планируется ли введение дополнительных мер, таких как блокировка пользователей за грубое обращение с Claude. Компания пояснила, что новые правила «призваны действовать лишь в крайних случаях, когда пользователи неоднократно и без видимой цели ведут себя жестоко по отношению к нашим моделям. Эти меры не распространяются на случаи, когда пользователи просто выражают недовольство или несогласие, обращаются к мрачным творческим темам, а также проводят тестирование или исследования модели».