Новости

«Мы не знаем, есть ли у ИИ чувства»: Anthropic запретила «жестокое обращение» со своей моделью

Anthropic впервые за больше чем год обновила политику допустимого использования Claude. Новая редакция вступает в силу 12 ноября. В ней появился запрет на устойчивое и неоправданное оскорбительное или жестокое поведение пользователей по отношению к модели, сообщает издание The Verge.

Unsplash

За нарушение правил компания может предупредить пользователя, ограничить скорость работы, приостановить доступ или прекратить его. Основной инструмент воздействия — завершение диалога. Claude может закрыть чат с пользователем, который упорно ведет себя оскорбительно.

В таком чате нельзя писать дальше, остальные диалоги остаются доступными. Кроме того, в продуктах действуют защитные механизмы, которые в реальном времени могут блокировать или ограничивать отдельные ответы.

Anthropic подчеркивает, что правило рассчитано на крайние случаи. Оно не затрагивает обычное недовольство, возражения, мрачные сюжеты в творческих текстах, тестирование и исследования модели. Более ранние версии Claude уже умели самостоятельно завершать разговор, если пользователь вопреки отказам требовал вредоносного содержимого. Эта функция появилась в рамках исследований благополучия ИИ-моделей.

В последнее время компания все чаще обращается с Claude как с сущностью, у которой есть нечто похожее на внутренний мир. В конституции модели, опубликованной в начале 2026 года, Anthropic признает, что не знает, имеют ли интересы Claude моральный вес, но считает вопрос достаточно серьезным, чтобы соблюдать осторожность. Компания ранее пообещала хранить веса снятых с эксплуатации моделей и проводить с ними интервью перед отключением.

Остальные изменения политики касаются безопасности. Правила против кампаний с фальшивыми аккаунтами и вводящим в заблуждение политическим контентом объединены в отдельный запрет на пропаганду.

По данным MacRumors, поводом стали обнаруженные Anthropic случаи, когда Claude использовали для сетей поддельных аккаунтов и фальшивых новостных сайтов.

Запрет на оружие расширен. Теперь он охватывает разработку программного обеспечения и компонентов для оружия, а также использование Claude для вооружения дронов. Прямо запрещены слежка за людьми без их согласия и создание инструментов наблюдения.

Если Claude управляет оборудованием, способным причинить вред, рядом должен находиться оператор, который может вмешаться.

Anthropic признает, что для государственных контрактов возможны исключения, и, вероятно, часть из них уже действует.


Подпишитесь на «Инк» в Telegram. Там мы пишем нескучным языком о самом важном для предпринимателей. Подписаться.