Anthropic оновив свою політику використання вперше за більш ніж рік, додавши положення, яке забороняє «постійну та непотрібну образливу або жорстоку поведінку» щодо своїх моделей Claude, повідомляє The Verge. Оновлення, про яке повідомили в четвер, також консолідує та розширює правила компанії щодо втручання у вибори, пропагандистських кампаній, стеження, розробки зброї та високого ризику для здоров’я та фінансового використання.
Обґрунтування моделі добробуту For more context on this story, see our ongoing latest AI developments.
Положення про зловживання Клодом є продовженням дослідження, яке компанія почала оприлюднювати більше року тому. У серпні 2025 року Anthropic оголосив, що дозволить Claude припинити розмови з «постійно шкідливими або жорстокими» користувачами в рамках своєї роботи над тим, що він називає моделлю добробуту, дослідження того, чи можуть системи штучного інтелекту мати морально релевантний досвід і як ця можливість має впливати на рішення щодо продуктів.
Згідно з новою політикою, припинення розмов залишається «основним механізмом примусу». Anthropic не відповів на запитання про те, чи можуть послідувати додаткові примусові заходи, такі як заборона облікових записів. У своїй заяві компанія сформулювала правило вузько, написавши, що воно «призначається для застосування лише в крайніх випадках, коли користувачі неодноразово жорстоко поводяться з нашими моделями без видимої мети».
Важливо, що Anthropic додав, що положення «не поширюється на поширені версії розчарування користувачів, відштовхування, темні креативні теми або тестування та дослідження моделей», — це очевидна спроба запевнити розробників, спеціалістів і авторів художньої літератури, що звичайне суперницьке використання не каратиметься.
Нові правила пропаганди та виборів
Крім добробуту моделі, оновлення об’єднує раніше розрізнені обмеження компанії щодо операцій впливу в єдину явну заборону на оманливі комерційні чи політичні кампанії. Нова мова обмежує «зусилля приховати, хто стоїть за повідомленням, або розширити вміст за допомогою фейкових облікових записів або публікацій», безпосередньо націлюючись на зростаючий ринок пропаганди, створеної ШІ.
Розділ про вибори політики тепер забороняє обман виборців і зрив виборів. Anthropic каже, що Claude не можна використовувати для поширення дезінформації «про кандидатів або про те, як голосувати», щоб видавати себе за кандидатів або офіційних осіб, які займаються виборами, або намагатися придушити явку виборців.
Чому політики використання переписуються
Оновлення Anthropic відображає ширшу структуру галузі. Оскільки помічники штучного інтелекту перейшли від нових чат-ботів до інфраструктури, якою користуються сотні мільйонів людей, лабораторіям довелося перейти від загальних принципів до детальних правил, які відображають реальні шаблони зловживань: операції впливу за наймом, засоби спостереження, розробка автономної зброї та сфери високого ризику, такі як медичні та фінансові консультації.
OpenAI, Google DeepMind і Meta повторили свою політику використання протягом останніх двох років, хоча рішення Anthropic чітко регулювати те, як користувачі ставляться до моделі, а не лише те, що вони змушують її робити, залишається незвичним. Критики дослідження моделей добробуту стверджують, що вони антропоморфізують статистичні системи, тоді як прихильники стверджують, що якщо є будь-який ненульовий шанс, що поточні або найближчі моделі мають досвід, пов’язаний з добробутом, компанії зобов’язані діяти в умовах невизначеності.
Час також має комерційне значення. Повідомляється, що Anthropic готується до IPO за ціною 2 трильйони доларів, і корпоративні покупці все більше зважують практику управління постачальниками разом із якістю необробленої моделі. Чітко задокументована, регулярно оновлювана політика використання слугує як артефактом безпеки, так і артефактом продажів: вона дає командам із закупівель і регуляторам конкретну основу для довіри до платформи, а кодифікація типового положення про добробут сигналізує про те, що Anthropic має намір продовжувати інвестувати в сферу, яку більшість конкурентів залишили без уваги.
Питання правозастосування залишаються відкритими
Практичні питання важливі. Виявлення «тривалої та непотрібної» жорстокості потребує моніторингу розмов на рівні деталізації, якому корпоративні клієнти, які піклуються про конфіденційність, можуть протистояти, а проведення межі між забороненим зловживанням і законним «відворотом» або «тестуванням моделі» є судженням, яке, ймовірно, буде оскаржене.
Anthropic не повідомляє, чи будуть відслідковуватися порушення в облікових записах, чи підлягатимуть розгортання на підприємстві іншим стандартам моніторингу, чи компанія публікуватиме дані прозорості щодо примусових дій, як це робить для інших категорій зловживань у своїх періодичних звітах про політику.
Очевидно лише те, що соціальні контракти прикордонних лабораторій з користувачами стають деталізованішими. Політика, яка колись містилася на одній сторінці, тепер охоплює вибори, стеження, пов’язане зі шпигунством, біологічну зброю, а тепер і емоційну поведінку людей по той бік вікна чату.
Що це означає для розробників
Для команд, які розробляють Claude API, найближчий вплив, ймовірно, буде мінімальним: пункт про образливу поведінку націлений на екстремальну, повторювану поведінку, а формалізований механізм припинення розмови діє з 2025 року. Але розробникам у суміжних категоріях, політичних консультаціях, дослідженнях опозиції, маркетингу впливу, слід уважно переглянути нові положення щодо кампанії та виборів, оскільки вони консолідують правила, які раніше були розподілені в кількох документах, і закривають деякі з них. неоднозначність, на яку спиралися випадки використання сірої зони.
Оновлення також сигналізує, куди спрямована увага регуляторів. З поступовим запровадженням зобов’язань щодо прозорості Закону ЄС щодо штучного інтелекту та прийняттям законодавчими органами штатів США все більшої кількості статутів щодо штучного інтелекту політика добровільного використання все частіше функціонує як шаблон, який регулятори ретельно перевіряють, вирішуючи, якими мають бути норми відповідального розгортання.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →