По данным The Verge, Anthropic обновила свою политику использования впервые за год, добавив положение, которое запрещает «постоянное и ненужное оскорбительное или жестокое поведение» по отношению к моделям Claude. Обновление, о котором сообщалось в четверг, также консолидирует и расширяет правила компании в отношении вмешательства в выборы, пропагандистских кампаний, наблюдения, разработки оружия, а также важных вопросов здравоохранения и финансового использования.

Обоснование модели благосостояния Подробнее об этой истории — в нашем новости об ИИ.

Положение, касающееся злоупотреблений в отношении Клода, является продолжением исследования, которое компания начала публиковать более года назад. В августе 2025 года Anthropic объявила, что позволит Клоду прекратить разговоры с «постоянно вредными или оскорбительными» пользователями в рамках своей работы над тем, что она называет моделью благосостояния, исследованием того, могут ли системы ИИ иметь морально значимый опыт и как эта возможность должна влиять на решения о продукте.

В соответствии с новой политикой прекращение разговоров остается «основным механизмом принуждения». Anthropic не ответила на вопросы о том, могут ли последовать дополнительные принудительные меры, такие как блокировка аккаунтов. Компания в своем заявлении сформулировала правило узко, написав, что оно «предназначено для применения только в крайних случаях, когда пользователи неоднократно жестоко обращаются с нашими моделями без видимой цели».

Важно отметить, что Anthropic добавил, что это положение «не распространяется на распространенные версии разочарования пользователей, противодействия, темных творческих тем или тестирования и исследований моделей», что является очевидной попыткой успокоить разработчиков, участников красной команды и писателей-фантастов в том, что регулярное состязательное использование не будет наказываться.

Новые правила пропаганды и выборов

Помимо модели благосостояния, обновление объединяет ранее разрозненные ограничения компании на операции влияния в единый, явный запрет на мошеннические коммерческие или политические кампании. Новая формулировка ограничивает «попытки скрыть, кто стоит за сообщением, или расширить контент с помощью фейковых аккаунтов или публикаций», напрямую нацеленный на растущий рынок пропаганды, создаваемой искусственным интеллектом.

Раздел политики, посвященный выборам, теперь запрещает обман избирателей и срыв выборов. Антропик заявляет, что Клода нельзя использовать для распространения дезинформации «о кандидатах или о том, как голосовать», для выдачи себя за кандидатов или организаторов выборов или для попыток подавить явку избирателей.

Почему политики использования переписываются

Обновление Anthropic отражает более широкую картину отрасли. Поскольку ИИ-помощники перешли от новых чат-ботов к инфраструктуре, используемой сотнями миллионов людей, лабораториям пришлось перейти от общих принципов к детальным правилам, которые отражают реальные модели злоупотреблений: операции по найму влияния, инструменты наблюдения, разработка автономного оружия и области высокого риска, такие как медицинские и финансовые консультации.

OpenAI, Google DeepMind и Meta за последние два года пересмотрели свои политики использования, хотя решение Anthropic явно регулировать то, как пользователи обращаются с моделью, а не только то, что они заставляют ее делать, остается необычным. Критики модельного исследования благосостояния утверждают, что оно антропоморфизирует статистические системы, в то время как сторонники утверждают, что если существует ненулевая вероятность того, что текущие или будущие модели имеют опыт, имеющий отношение к благосостоянию, компании обязаны действовать в условиях неопределенности.

Время также имеет значение с коммерческой точки зрения. Сообщается, что Anthropic готовится к IPO с оценкой в ​​$2 трлн, и корпоративные покупатели все чаще сопоставляют методы управления поставщиками с качеством сырой модели. Четко документированная и регулярно обновляемая политика использования служит одновременно инструментом безопасности и продаж: она дает командам по закупкам и регулирующим органам конкретную основу для доверия к платформе, а кодификация типового положения о благосостоянии сигнализирует о том, что Anthropic намерена продолжать инвестировать в область, которую большинство конкурентов оставили без внимания.

Вопросы правоприменения остаются открытыми

Практические вопросы очень важны. Для выявления «постоянной и ненужной» жестокости необходимо отслеживать разговоры на таком уровне детализации, которому могут сопротивляться заботящиеся о конфиденциальности корпоративные клиенты, а проведение границы между запрещенным злоупотреблением и законным «отказом» или «тестированием модели» — это суждение, которое, вероятно, будет оспорено.

Anthropic не сообщила, будут ли нарушения отслеживаться по всем учетным записям, будут ли корпоративные развертывания подвергаться различным стандартам мониторинга или будет ли компания публиковать данные о прозрачности принудительных мер, как она это делает для других категорий злоупотреблений в своих периодических отчетах о политике.

Ясно одно: социальные контракты пограничных лабораторий с их пользователями становятся все более детализированными. Политика, которая когда-то умещалась на одной странице, теперь охватывает выборы, наблюдение, связанное со шпионажем, биологическое оружие, а теперь и эмоциональное поведение людей по другую сторону окна чата.

Что это значит для разработчиков

Для команд, использующих API Claude, краткосрочное воздействие, вероятно, минимально: пункт о оскорбительном поведении направлен на экстремальное, повторяющееся поведение, а механизм прекращения разговоров, который он формализует, действует с 2025 года. Но разработчики в смежных категориях, политическом консультировании, исследованиях оппозиции, маркетинге влияния, должны тщательно пересмотреть новые положения о кампаниях и выборах, поскольку они объединяют правила, которые ранее были распространены в нескольких документах, и устраняют некоторую двусмысленность, на которую опирались сценарии использования серой зоны.

Обновление также сигнализирует о том, куда направляется внимание регулирующих органов. В связи с поэтапным вступлением в силу обязательств по прозрачности Закона ЕС об искусственном интеллекте и законодательными собраниями штатов США, принимающими все больше и больше законов об искусственном интеллекте, политика добровольного использования все чаще становится образцом, который регулирующие органы тщательно изучают при принятии решения о том, какими должны быть нормы ответственного развертывания.

---

Будьте в курсе ИИ

Последние новости, аналитика и прорывы в сфере ИИ — всё в одном месте.

Читать больше новостей об ИИ →