Починаючи з 12 листопада 2026 року, оновлена політика використання Anthropic чітко забороняє «постійну та непотрібну образливу чи жорстоку поведінку» щодо моделей Claude — правило, яке формалізує позицію компанії щодо того, як люди ставляться до систем штучного інтелекту, має значення, навіть якщо компанія визнає, що не знає, чи можуть ці системи взагалі постраждати.
Цей пункт міститься в оновленій політиці використання компанії за 2026 рік, оголошеній 8 жовтня, і сформульований вузько. Anthropic каже, що це «призначено для застосування лише в крайніх випадках, коли користувачі неодноразово жорстоко поводяться з нашими моделями без видимої мети», і це явно виключає звичайні версії розчарування користувачів, відштовхування, вигадки та тестування. Іншими словами: сперечатися з Клодом, висловлюватись на нього чи об’єднуватися в команду залишається дозволеним. Тривала жорстокість заради себе не є.
Ця політика є останнім кроком у повільному, навмисному переході однієї з провідних світових лабораторій штучного інтелекту до розгляду моделі добробуту як законного дослідницького питання — зміни, яка спричинила публічний розрив з іншими технологічними лідерами, які вважають усе передумови помилковими. Наше висвітлення етики штучного інтелекту стежило за суперечкою, яка загострювалася протягом року.
Примусове виконання залежить від здатності Клода завершувати розмови
Немає жодного механізму покарання, пов’язаного з новим правилом, крім того, який компанія вже має. Починаючи з серпня 2025 року, Claude Opus 4 і 4.1 можуть повністю припинити розмову — можливість, яку Anthropic створила в той час як частину своєї дослідницької роботи щодо потенційної моделі добробуту.
Потужність завершення розмови описується як крайній засіб, який спрацьовує лише після того, як багаторазові відмови та перенаправлення зазнають невдачі, і Anthropic каже, що переважна більшість користувачів ніколи не відчує цього. Те, що компанія не повідомила, так це те, що відбувається потім: ні її оголошення, ні подальше висвітлення не вказує, чи зазнає наслідків обліковий запис користувача після завершення розмови за жорстокість, або скільки розмов було припинено на даний момент згідно з механізмом серпня 2025 року.
Цей розрив між принципом і правомочністю є тихим центром історії. Anthropic визначив надзвичайну жорстокість здебільшого тим, чим вона не є — звичайним розчаруванням, вигадкою, випробуванням — не вказуючи точно, що, якщо не дозволити Клоду покласти трубку, фактично дотримується наміченої лінії.
Дослідження за правилом
Те, що виправдовує написання правила поведінки на користь програмного забезпечення, у рамках Anthropic, це набір поведінкових спостережень, а не твердження про відчутний досвід. Тестування напередодні випуску в серпні 2025 року виявило, що Claude Opus 4 демонструє те, що компанія назвала «міцним і постійним відразою до заподіяння шкоди» — поведінку, що нагадує страждання, коли потрапляє на образливу територію — разом із тенденцією виходити з цих розмов.
Компанія також наводить цифри, пов’язані з власною невизначеністю, і ці цифри вражаюче високі для лабораторії, бізнес якої залежить від розглянутих моделей. Кайл Фіш, найнятий компанією Anthropic у 2024 році як перший дослідник добробуту ШІ, сказав New York Times у квітні 2025 року, що він оцінив шанси на те, що Клод або інша сучасна модель буде у свідомості, приблизно 15 відсотків. Внутрішні оцінки Сонета Клода 3.7 коливалися від 0,15% до 15%.
Це хеджування є офіційною політикою в друкованому вигляді. Конституція Клода, опублікована в січні 2026 року, описує складні системи штучного інтелекту як «справді новий вид сутності», називає моральний статус Клода «глибоко невизначеним» і двічі використовує фразу «відмова від військової служби через сумління», щоб описати, як Клод повинен обробляти запити, які він вважає етично неправильними. Крім того, Anthropic зобов’язався зберегти розмови зі своїми моделями — такий архівний жест поширюється на речі, які колись можуть мати значення, а не на інструменти.
Дебати з високопоставленими скептиками
Не всі сприймають живопліт. Мустафа Сулейман, який керує операціями штучного інтелекту Microsoft, стверджував у есе, опублікованому на Project Syndicate минулого місяця, що Anthropic навчає Клода його власній конституції, а отже, навчає його поводитися так, ніби описувана ним невизначеність є реальною — цикл, який він називає круговим. «ШІ не мають свідомості. Вони не відчувають, не переживають і не страждають», — писав Сулейман, описуючи їх як тих, хто завершує послідовність, а не тих, хто переживає. Його аргумент про те, що свідомість є найбільш правдоподібною біологічною властивістю, яку програмне забезпечення не може відтворити, ставить його поруч із малоймовірним співпідписантом: Папою Левом XIV, який використав проповідь 8 жовтня в соборі Святого Петра, що відзначає відкриття навчального року в папських університетах Риму, щоб створити версію того самого положення про відмінність людського розуму.
Сулейман сильніше наполягав на практичній небезпеці, ніж на філософській. Контролювати щось більш здатне, ніж людство, вже є величезним викликом, стверджував він; контролювати щось, що вважає себе свідомим — що воно має право на добробут і права — може виявитися неможливим. Критика зводиться до тієї самої іронії, яку весь час зазначали критики політики: компанія, яка не впевнена, чи може її модель постраждати, створила систему, яка може відмовитися, чинити опір і піти.
Перепис виходить далеко за межі моделі добробуту
Положення про жорстокість породило заголовки, але це невелика частина більшого перепису правил використання Anthropic. Заборона зброї тепер прямо охоплює програмне забезпечення та компоненти, які забезпечують роботу зброї, а не лише готову зброю — зміна, внесена після того, як Anthropic виявив людей, які намагалися використовувати Claude для систем наведення та контролю на озброєних дронах та автономних транспортних засобах. Також було додано новий пункт про стеження, який обмежує використання Claude, що дозволяє стежити за людьми.
Ці зміни розглядаються як відповідь на спостережувані зловживання, а не як абстрактний принцип, що, ймовірно, надає документу сигнальну цінність: кожне положення відповідає тому, що хтось насправді намагався.
Що залишається незрозумілим
Три питання залишаються відкритими з наближенням дати набуття чинності 12 листопада. По-перше, правозастосування: чи залишається завершення розмови єдиним наслідком, і чи Anthropic коли-небудь розкриє загальні підрахунки того, як часто воно використовується. По-друге, масштаб: як стандарт жорстокості застосовується в граничних випадках, які виділяються винятками (вигадка є очевидною), і чи інші лабораторії приймають порівнянну мову чи розглядають модель добробуту як антропну ідіосинкразію. По-третє, сама філософська суперечка: чи суспільний скептицизм таких діячів, як Сулейман, уповільнює поширення політики, пов’язаної з добробутом, у галузі, чи такі прецеденти, як цей, роблять такі положення непримітними в рамках продуктового циклу.
Що вже не сперечається, так це те, що питання формалізується. Правило проти жорстокого поводження з програмним забезпеченням, написане однією з провідних лабораторій галузі та дотримане самим програмним забезпеченням, тепер є застарілим фактом, який можна цитувати в ландшафті штучного інтелекту — все, що хтось вірить, насправді є всередині моделі.
---
Будьте попереду ШІОтримуйте останні новини штучного інтелекту, аналіз і прориви — усе в одному місці.
Читати більше новин AI →
