Компания Anthropic в свежем отчете о «злоупотреблениях» своими ИИ-моделями рассказала о блокировке аккаунтов, владельцы которых генерировали тексты в Claude, впоследствии опубликованные или вышедшие в эфир «российских государственных и финансируемых государством СМИ». Внимание на публикацию обратил портал «Код.ру». 

По данным Anthropic, Claude использовали не сами СМИ, а люди, чьи тексты затем попадали в редакционные цепочки. Один такой пользователь (разработчики называют его экс-главредом Sputnik Moldova) с помощью ИИ перерабатывал румынские и молдавские новости в русскоязычные.

Еще один пользователь (компания описывает его как связанного с Россией подрядчика) брал материалы из российских телеграм-каналов и превращал их с помощью Claude в испаноязычные тексты для Sputnik en Español и других ресурсов, ориентированных на аудиторию Латинской Америки.

Владелец другого заблокированного аккаунта использовал Claude для подготовки бегущих строк, экранных подписей, коротких заголовков и закадровых текстов. Anthropic в отчете подчеркивает, что как минимум один такой материал попал в эфир.

Отдельно владельцы Claude выделили случай, когда часть утверждений чат-бот пометил как непроверенные. Пользователь попросил модель убрать оговорки и представить информацию как подтвержденную, изменив степень уверенности исходного материала.

Выявленные индикаторы в текстах компания передала коллегам и партнерам по индустрии. РИА «Новости», RT и Sputnik заявления Anthropic не комментировали.

Источник: «Код.ру», Anthropic