Anthropic запретила пользователям жестокое обращение с чат-ботом Claude

Anthropic запретила пользователям жестокое обращение с нейросетью Claude

Речь идет только о «крайних случаях», когда пользователи «неоднократно и без какой-либо явной цели ведут себя жестоко по отношению к моделям», пояснили в Anthropic

Входит в сюжеты
В этой статье

Американская компания Anthropic обновила Политику использования нейросети Claude, запретив «систематическое и необоснованное оскорбительное или жестокое обращение» с моделями искусственного интеллекта (ИИ).

Речь идет только о «крайних случаях», когда пользователи «неоднократно и без какой-либо явной цели ведут себя жестоко по отношению к моделям».

«Оно [правило] не распространяется на обычные проявления недовольства и несогласия со стороны пользователей, творческие произведения с мрачной тематикой, а также тестирование моделей и проведение исследований», — говорится в сообщении.

Летом прошлого года Anthropic объявила, что модели Claude Opus 4 и 4.1 получили возможность самостоятельно прекращать диалоги в чатах, которые «вызывают у них стресс».

Функция была разработана в рамках предварительных исследований «благополучия» моделей ИИ. Они показали неприятие Claude запросов, способных причинить вред. В частности, дискомфорт вызывали запросы пользователей на контент сексуального характера с участием несовершеннолетних, а также попытки получить информацию, связанную с насилием или совершением терактов.

Кроме того, Anthropic запретила использовать чат-бот Claude для вмешательства в выборы, слежки за людьми без их ведома, разработки оружия.

В конце сентября агентство Reuters сообщало, что Anthropic предупредит потенциальных инвесторов в своем первичном публичном размещении (IPO) о «катастрофических или экзистенциальных рисках для человечества» со стороны ИИ. В частности, речь идет о рисках, связанных с ИИ-моделями компании, которые могут демонстрировать «самостоятельное поведение», «сопротивляться отключению», «скрывать или манипулировать информацией» и поведение, которое «напоминает шантаж», говорится в проспекте IPO Anthropic.

Оставайтесь на связи с РБК в «Максе».