Anthropic в новом обновлении политики использования чат-бота Claude среди прочего запретила грубо с ним обращаться. Это касается случаев, когда пользователь систематически и неоправданно оскорбляет нейросеть. В компании уточнили, что высказывать недовольство результатом работы все еще можно.

«Мера будет применяться только в крайних случаях, когда пользователи неоднократно жестоко обращаются с нашими моделями без цели. Она не распространяется на привычные проявления недовольства пользователей, ответную реакцию и тестирование», — говорится в пресс-релизе. 

Так, Claude сможет прекращать диалог с пользователем, который его оскорбляет. Это дополнение войдет в перечень других причин, по которым чат-боту официально разрешено не выполнять команды человека. Возможность ввели в мае 2025 года — для «редких случаев». 

Что еще теперь запрещено делать в чат-боте:

  • Создавать политические кампании, вводящие в заблуждение, а также организовывать накрутку для продвижения материалов.
  • Писать статьи для обмана избирателей или срыва политических выборов.
  • Не только разрабатывать оружие, но и создавать ПО для управления им. 
  • Отслеживать людей без их согласия, искать компромат на тех, кого планируется арестовать, или против кого готовятся обвинения (касается правоохранительной деятельности). 

   

В сентябре Anthropic рассказала о блокировке аккаунтов, владельцы которых генерировали тексты в Claude, впоследствии опубликованные или вышедшие в эфир «российских государственных и финансируемых государством СМИ»: Sputnik Moldova, РИА «Новости», RT. 

Источник: Anthropic