Через кілька днів після того, як Anthropic почала розгортати невидимі водяні знаки на результатах тексту та зображень Клода, ця функція породжує саме те протиріччя, яке передбачали критики: користувачі хвилювалися, що знаки викриють їх за використання штучного інтелекту на роботі чи в класі, розробники документували, як водяний знак поводиться в реальних робочих процесах кодування, а також невеликий, але помітний ринок інструментів, які обіцяють його усунути.

Anthropic каже, що ця зміна приводить Claude у відповідність до Закону Європейського Союзу про штучний інтелект, чиї правила прозорості стали чинними для нових моделей після 2 серпня 2026 року. Стаття 50 акту вимагає від постачальників систем штучного інтелекту робити машинно-генерований результат «виявленим як штучно створений». Anthropic підтвердив, що всі нові моделі, які пропонуються в усьому світі, а не лише в ЄС, позначатимуть контент, створений ШІ, «з першого дня» з пільговим періодом до грудня 2026 року для оновлення попередньо випущених моделей. For more context on this story, see our ongoing artificial intelligence updates.

Самі знаки непомітні. Згідно зі статтею підтримки Anthropic, текстові виходи «несуть вбудовані водяні знаки», тоді як створені файли містять метадані походження з цифровим підписом, якщо це підтримується форматом. Більш ранні моделі Claude також будуть оновлені, щоб позначати текст, тобто весь автопарк зрештою буде штампувати свою продукцію.

Водяний знак покриває відредагований текст, а не лише створений текст

Деталь, яка перетворила технічну цікавість на негативну реакцію, була виявлена Ars Technica 13 серпня: водяний знак стосується вмісту, який Клод обробляє, а не лише контенту, який він створює з нуля. Ars охарактеризував цей підхід як «викинути його з орбіти», оскільки Anthropic позначає весь оброблений вміст там, де він підтримується, навіть якщо власні вказівки ЄС не вимагають цього, якщо система штучного інтелекту виконує «допоміжну функцію для стандартного редагування» (прикладом регламенту є виправлення граматики) — або якщо вона «суттєво не змінює» текст користувача.

Ця відмінність має значення, оскільки водяний знак, застосований на рівні моделі, не може відрізнити оптову генерацію від виправлення коми. Ешлі Беленджер з Ars Technica зауважив, що Клод може в кінцевому підсумку штампувати саме той вид злегка підправлених людських рукописей, які закон був написаний, щоб залишити в спокої. На практиці знак позначає все, що обробив Клод — навіть документ, який написала людина й попросила Клода лише відшліфувати.

Користувачі бояться бути спійманими на роботі чи в школі

Реакція користувачів була швидкою. 13 серпня TechCrunch повідомила, що деякі користувачі Claude «розлючені тим, що нові водяні знаки Anthropic зловлять їх за використанням цього на роботі чи на уроках». Співробітники, які тихенько покладаються на Клода, щоб писати електронні листи, звіти чи слайди, — і студенти, які використовують це під час виконання завдань — тепер стикаються з можливістю того, що начальник або викладач зможе перевірити участь ШІ за допомогою інструменту виявлення.

Ars Technica оформила цю динаміку як «червону літеру» — невидимий знак використання штучного інтелекту, який читач не може побачити, але інституції незабаром побачать. Оскільки водяний знак переміщується разом із текстом через копіювання та вставлення та зміни формату, звичайний захист «Я щойно трохи відредагував це» більше не залишає відбитків пальців ШІ.

Ринок видалення вже зароджується

Там, де є водяний знак, слідує галузь видалення. SC Media повідомила, що через кілька днів після оновлення Claude вже з’являється ринок інструментів для видалення водяних знаків AI. Задокументовано розшифрувати, що розробники активно намагаються зламати схему маркування, досліджуючи, як вона поводиться під час перефразування, перекладу та переформатування.

Перше тестування свідчить про те, що водяний знак стійкий до випадкового використання, але негерметичний у професійних умовах. У звіті The New Stack зроблено висновок, що позначка «виживає при копіюванні та вставці, але не в реальному робочому процесі розробників», тобто розробники програмного забезпечення, які суттєво переробляють код, запропонований штучним інтелектом, як частину звичайного проектування, можуть змити позначку, навіть не маючи на це наміру.

Як Марк насправді працює

Широко поширений візуальний пояснювач, опублікований на declaude.org, руйнує механізм. У тексті немає пікселів, у яких можна було б приховати дані, і жодні метадані не витримують копіювання та вставлення, тому водяний знак живе у «виборі між словами». Коли модель пише, вона неодноразово вибирає з кількох рівноправдоподібних наступних слів; секретний криптографічний ключ тихо зміщує ці вибори до шаблону, який може виявити лише власник ключа.

Техніка походить від досліджень Kirchenbauer та ін. з 2023 року, який розділив слова-кандидати на «зелений» і «червоний» списки та схилив покоління до зелених токенів. SynthID від Google досягає подібної мети більш тонким шляхом, і Google використовує водяні знаки для тексту з додатка Gemini та веб-інтерфейсу з 2024 року — його API є задокументованим винятком. Станом на серпень 2026 року нові моделі Claude позначають текст на рівні моделі, а попередні моделі будуть продовжені.

Скептики кажуть, що видалення залишається тривіальним

Не всі впевнені, що гонка озброєнь йде на користь Anthropic. У широко розповсюдженому есе інженер Шон Гедеке стверджував, що текстові водяні знаки «завжди буде тривіально видалити», оскільки текст є надзвичайно стислим носієм — будь-яка зміна, достатньо сильна, щоб пережити рішуче видалення, — це зміна, яку помітить читач-людина. Інструменти перефразовування, повторні переклади та навмисне переформулювання – все це загрожує вичистити статистичні закономірності без приниження сенсу.

Дебати точаться в спільнотах розробників: два окремі пояснювачі водяних знаків увійшли до числа найбільш обговорюваних історій на Hacker News цього тижня, що викликало сотні точок взаємодії між ними.

Що станеться далі

Anthropic заявила, що врешті-решт поділиться деталями про те, як виявляти позначки — технічна підтримка, яку вимагає регламент ЄС, — але поки не буде надіслано публічний інструмент виявлення, сторонні сторони не можуть перевірити, наскільки ретельним є маркування. Компанія також визнала, що водяні знаки не працюватимуть на «деяких платформах або функціях», які їх не підтримують.

У грудні 2026 року закінчується кінцевий термін відповідності старішим моделям, а конкуруючі лабораторії спостерігають, чи не покарають користувачі Anthropic за прозорість. Наступні кілька місяців перевірятимуть пропозицію, якої індустрія уникала роками: чи можуть постачальники штучного інтелекту забезпечити відстеження своїх результатів, не завдаючи їм шкоди людям, які покладаються на нього.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →