Anthropic почне застосовувати невидимі водяні знаки до тексту, згенерованого моделями Claude, компанія підтвердила цього тижня, ставши останнім постачальником штучного інтелекту, який додає машиночитані сигнали походження у відповідь на нові європейські правила прозорості.
Зміна, детально описана на оновленій сторінці підтримки, означає, що вміст, створений Клодом, матиме прихований підпис, розроблений таким чином, щоб його можна було копіювати та вставляти в іншому місці. Це пряма відповідь на Закон ЄС про прозорість штучного інтелекту, який набув чинності 2 серпня і вимагає від компаній штучного інтелекту позначати створений або відредагований контент таким чином, щоб його могли виявити інші системи.
Як працює водяний знак
Anthropic повідомила, що всі моделі, випущені після 2 серпня, автоматично включатимуть технологію створення водяних знаків як на комп’ютерному тексті, так і на файлах. Для файлів компанія приймає відкритий стандарт C2PA, структуру облікових даних вмісту, яка вже використовується деякими виробниками фотоапаратів та інструментів редагування зображень для запису того, як було створено медіафайл.
Текстовий водяний знак вбудовано на рівні моделі, а не застосовано пізніше. Відповідно до допоміжної документації Anthropic, «оскільки водяний знак є частиною тексту, він буде переміщатися разом з текстом, коли його копіюватиме та вставлятиме в інше місце, і може зберігатися під час редагування. Водяний знак буде застосовано на рівні моделі, що означає, що він буде присутній незалежно від того, з якого продукту Claude чи поверхні надходить текст».
Компанія додала, що планує розширити підтримку водяних знаків і на старі моделі. Ця функція застосовуватиметься до лінійки продуктів Anthropic, включаючи API платформи Claude, програму чату Claude, Claude Code, Claude Cowork і Claude Tag.
Не зовсім зрозуміло, скільки саме редагування потрібно зробити користувачеві, щоб видалити позначку, і Anthropic публічно не описує цю техніку. Водяний знак на тексті є технічно складним, оскільки невеликі зміни у формулюванні можуть порушити крихкі статистичні моделі, що є давньою проблемою для дослідників у цій галузі.
Немає відмови для користувачів
Примітно, що користувачі Claude не зможуть вимкнути водяний знак. Налаштування виконується самою моделлю, а не перемикається за запитом, що означає, що кожен, хто генерує текст через поверхню Claude, буде позначений незалежно від того, хоче він цього чи ні.
Така позиція, ймовірно, спричинить негативну реакцію деяких професійних користувачів. Письменники, розробники та компанії, які використовують Claude для розробки вмісту, звикли до чистого, немаркованого виводу, і деяким може бути незручно, коли в Інтернеті стоїть невидимий підпис після тексту. Anthropic, схоже, дійшов висновку, що відповідність нормативним вимогам переважує цю перевагу.
Частина ширшої галузевої боротьби
Антропік діє не сам. Вимоги ЄС щодо прозорості спровокували гонку серед платформ штучного інтелекту та контенту за додавання сигналів про походження до того, як постукають регулятори.
Буквально минулого тижня музична платформа AI Suno заявила, що почне позначати треки, створені на її сервісі після хвилі судових оскаржень щодо аудіо, створеного штучним інтелектом. Минулого місяця платформа інформаційних бюлетенів Substack співпрацювала з фірмою Pangram для виявлення контенту, створеного штучним інтелектом, а генеральний директор Substack Кріс Бест публічно назвав «Claudefishing» — його термін для людей, які використовують штучний інтелект для заповнення платформ матеріалами низької якості.
Тиск поширюється далеко за межі прямих конкурентів Anthropic. Відповідно до звіту TechCrunch, Black Forest Labs, Google, Meta, Microsoft, OpenAI і Synthesia взяли на себе зобов’язання дотримуватися кодексу прозорості ЄС, сигналізуючи про те, що водяні знаки швидко стають базовими очікуваннями галузі, а не відмінністю.
Чому походження раптом стало терміновим
Поштовх до водяних знаків відображає дві збіжні тривоги. Перший — нормативний: Закон ЄС про штучний інтелект набув чинності, і компанії, які його не дотримуються, загрожують значним штрафам. Раннє створення інфраструктури походження дешевше, ніж її модернізація під тиском правоохоронних органів.
Другий – репутаційний. Оскільки текст, зображення, аудіо та відео, створені штучним інтелектом, заполонили соціальні платформи, видавці та платформи стикаються з дедалі більшою негативною реакцією через «помиї штучного інтелекту», синтетичний вміст низької якості, який витісняє людську роботу та підриває довіру. Невидимі водяні знаки пропонують технічну відповідь на питання, яке не може вирішити лише модерація: це було написано машиною?
Для Anthropic, яка побудувала свій бренд навколо безпеки штучного інтелекту, використання водяних знаків також є кроком довіри. Компанія, яка рекламує себе як відповідальну альтернативу, має сильні стимули лідирувати у сфері прозорості, а не бути поміченою зволіканням.
Найскладніші питання залишаються невирішеними. Водяні знаки допомагають, лише якщо інструменти виявлення справді шукають їх і якщо знаки виявляються достатньо надійними, щоб витримати редагування, переформатування та відмивання, які відбуваються під час переміщення вмісту через відкриту мережу. Anthropic робить ставку на те, що вбудовування сигналу на рівні моделі є найдовговічнішим підходом. Чи витримає це на практиці, буде перевірено швидко й публічно протягом наступних місяців.
Для постійного висвітлення політики штучного інтелекту та інструментів, які змінюють галузь, додайте в закладки [висвітлення останніх новин AI Buzz Wire щодо штучного інтелекту] (https://aibuzzwire.news).
