Anthropic меняет политику использования, чтобы запретить злоупотребление моделью и вмешательство в выборы
Anthropic обновила правила использования в четверг, закрепив новые запреты на вмешательство в выборы, программное обеспечение для оружия и слежку. Но, пожалуй, больше всего внимания привлекает новый запрет на продолжительные словесные оскорбления модели, которые теперь прямо запрещены.
После обновления в августе Claude обучена прекращать разговоры с «настойчиво вредными или оскорбительными взаимодействиями со стороны пользователей», однако новая политика прямо запрещает пользователям продолжать такие разговоры.
«Обновление политики предназначено для применения только в крайних случаях, когда пользователи неоднократно проявляют жестокость по отношению к нашим моделям без какой-либо очевидной цели, — говорится в сообщении. — Оно не распространяется на обычные проявления раздражения пользователей, возражения, мрачные творческие темы, а также тестирование и исследование моделей».
Это изменение последовало после того, как Anthropic начала искать сотрудничества с известными религиозными учёными, в некоторых случаях стремясь убедить их в том, что Claude может обладать сознанием или душой.
Отдельные разделы правил использования запрещают пользователям участвовать в масштабных обманных кампаниях, например использовать Claude для ведения фальшивых аккаунтов или выдуманных новостных изданий. Политика также содержит правила, запрещающие вводить избирателей в заблуждение или срывать выборы; они собраны в разделе под названием «Не подрывайте демократические процессы».
Переведено автоматически с английского. Оригинал статьи — по ссылке ниже.