Спустя несколько дней после того, как Anthropic начал размещать невидимые водяные знаки на текстовых и графических выводах Клода, эта функция вызывает именно те препятствия, которые предсказывали критики: пользователи беспокоятся, что отметки выдадут их за использование ИИ на работе или в классе, разработчики документируют, как водяной знак ведет себя в реальных рабочих процессах кодирования, и небольшой, но заметный рынок инструментов, обещающих его убрать.

Anthropic заявляет, что это изменение приводит Клода в соответствие с Законом Европейского Союза об искусственном интеллекте, правила прозрачности которого стали применяться для новых моделей после 2 августа 2026 года. Статья 50 закона требует, чтобы поставщики систем искусственного интеллекта делали результаты машинной генерации «обнаруживаемыми как искусственно созданные». Anthropic подтвердила, что все новые модели, предлагаемые по всему миру, а не только в ЕС, будут помечать созданный искусственным интеллектом контент «с первого дня» с льготным периодом до декабря 2026 года для обновления ранее выпущенных моделей. Подробнее об этой истории — в нашем новости об ИИ.

Сами метки невидимы. Согласно статье поддержки Anthropic, текстовые выходные данные «несут встроенные водяные знаки», а сгенерированные файлы содержат метаданные происхождения с цифровой подписью, если формат их поддерживает. Более ранние модели Claude также будут обновлены для маркировки текста, а это означает, что весь парк в конечном итоге будет ставить штампы на своей продукции.

Водяной знак покрывает отредактированный текст, а не только сгенерированный текст

Деталь, которая превратила техническое любопытство в негативную реакцию, была раскрыта Ars Technica 13 августа: водяной знак применяется к контенту, который обрабатывает Клод, а не только к контенту, который он генерирует с нуля. Ars охарактеризовал этот подход как «сбросить ядерную бомбу с орбиты», поскольку Anthropic маркирует весь обработанный контент там, где он поддерживается, даже несмотря на то, что собственное руководство ЕС не требует этого, когда система искусственного интеллекта выполняет «вспомогательную функцию для стандартного редактирования» (примером регулирования является исправление грамматики) или когда она «существенно не изменяет» текст пользователя.

Это различие имеет значение, поскольку водяной знак, применяемый на уровне модели, не может отличить массовое поколение от исправления запятой. Эшли Белэнджер из Ars Technica отметила, что Клод может в конечном итоге штамповать именно тот слегка подкрашенный человеческий почерк, который закон был написан для того, чтобы оставить его в покое. На практике этот знак отмечает все, что обрабатывал Клод — даже документ, который написал человек и попросил Клода только доработать.

Пользователи боятся, что их поймают на работе и в школе

Реакция пользователей была быстрой. TechCrunch сообщил 13 августа, что некоторые пользователи Claude «возмущены тем, что новые водяные знаки Anthropic заставят их использовать их на работе и на занятиях». Сотрудники, которые незаметно полагаются на Клода при составлении электронных писем, отчетов или слайдов, а также студенты, которые используют его при выполнении заданий, теперь сталкиваются с возможностью того, что начальник или инструктор может проверить участие ИИ с помощью инструмента обнаружения.

Ars Technica охарактеризовала эту динамику как «Алую букву» — невидимый знак использования ИИ, который читатель не может увидеть, но вскоре может увидеть учреждения. Поскольку водяной знак перемещается вместе с текстом при копировании и вставке и изменении формата, обычная защита «Я просто немного отредактировал его» больше не оставляет отпечатков пальцев ИИ.

Рынок переездов уже развивается

Там, где есть водяной знак, следует индустрия удаления. SC Media сообщила, что рынок инструментов для удаления водяных знаков с использованием искусственного интеллекта уже появляется через несколько дней после обновления Claude. Decrypt документально подтвердил, что строители активно пытаются взломать схему маркировки, исследуя, как она ведет себя при перефразировании, переводе и переформатировании.

Ранние испытания показывают, что водяной знак устойчив к случайному обращению, но протекает в профессиональных условиях. В репортаже The New Stack сделан вывод, что знак «выдерживает копирование и вставку, но не реальный рабочий процесс разработки» — это означает, что разработчики программного обеспечения, которые существенно переделывают предложенный ИИ код в рамках обычного проектирования, могут стереть знак, даже не желая этого.

Как на самом деле работает знак

Широко распространенное визуальное объяснение, опубликованное на сайте declaude.org, объясняет этот механизм. В тексте нет пикселей, в которых можно было бы скрыть данные, и никакие метаданные не выдерживают копирования и вставки, поэтому водяной знак живет в «выборе между словами». Как пишет модель, она неоднократно выбирает среди нескольких одинаково правдоподобных следующих слов; секретный криптографический ключ незаметно смещает этот выбор в сторону шаблона, который может обнаружить только владелец ключа.

Этот метод восходит к исследованиям Кирхенбауэра и др. с 2023 года, что позволило разделить слова-кандидаты на «зеленые» и «красные» списки и склонить генерацию к зеленым токенам. SynthID Google достигает аналогичного пункта назначения более тонким путем, а с 2024 года Google помечает текст водяными знаками из приложения и веб-интерфейса Gemini — его API является задокументированным исключением. По состоянию на август 2026 года новые модели Claude маркируют текст на уровне модели, а за ними последуют более ранние модели.

Скептики говорят, что удаление остается тривиальным

Не все убеждены, что гонка вооружений благоприятствует антропологии. В широко распространенном эссе инженер Шон Гедеке утверждал, что текстовые водяные знаки «всегда будет легко удалить», поскольку текст представляет собой чрезвычайно сжатый носитель: любое изменение, достаточно сильное, чтобы выдержать решительное удаление, является изменением, которое заметит читатель-человек. Инструменты перефразирования, повторный перевод и преднамеренное изменение формулировок — все это грозит стереть статистические закономерности, не ухудшив при этом смысл.

Дебаты разворачиваются в сообществах разработчиков: два отдельных объяснения водяных знаков вошли в число самых обсуждаемых историй на Hacker News на этой неделе, привлекая сотни точек соприкосновения между ними.

Что будет дальше

Anthropic заявила, что в конечном итоге поделится подробностями о том, как обнаружить маркировку (техническая поддержка требуется в соответствии с правилами ЕС), но до тех пор, пока не будет выпущен общедоступный инструмент обнаружения, внешние стороны не смогут проверить, насколько тщательна маркировка на самом деле. Компания также признала, что водяные знаки не будут работать на «некоторых платформах или функциях», которые их не поддерживают.

Учитывая, что старые модели должны соответствовать требованиям до декабря 2026 года, а конкурирующие лаборатории будут следить за тем, накажут ли пользователи Anthropic за прозрачность, в ближайшие несколько месяцев будет проверено предложение, которого отрасль избегала годами: смогут ли поставщики ИИ сделать свою продукцию отслеживаемой, не делая ее токсичной для людей, которые на нее полагаются.

---

Будьте в курсе ИИ

Последние новости, аналитика и прорывы в сфере ИИ — всё в одном месте.

Читать больше новостей об ИИ →