OpenAI объявила 5 октября, что начнет добавлять невидимые водяные знаки в текст, генерируемый ChatGPT и Кодексом для пользователей в Европейском Союзе, что является ее конкретным ответом на правила происхождения текста Закона ЕС об искусственном интеллекте. В сообщении в блоге под названием «Наш подход к правилам происхождения текста в ЕС» компания сообщила, что водяные знаки будут внедрены «в ближайшие недели» для соответствующей продукции в блоке. Об этом плане сообщили в тот же день TechCrunch, The Verge, BleepingComputer, Engadget и другие издания.

Технология, лежащая в основе этого изменения, называется textGrain. Вместо того, чтобы вставлять видимый знак, textGrain тонко управляет выбором слов в модели, поэтому результирующий текст несет в себе статистический шаблон, который можно обнаружить позже. Читатели ничего не заметят при чтении или копировании текста, сгенерированного искусственным интеллектом; для обнаружения требуется доступ к детектору OpenAI, который недоступен для широкой публики. Чтобы получить более широкий взгляд на то, как регулирующие органы и лаборатории сталкиваются из-за правил ИИ, следите за нашими постоянными обзорами политики в области ИИ.

Как работает водяной знак textGrain

Подход OpenAI изменяет процесс выбора токена во время генерации. Компания заявляет, что textGrain «слегка меняет выбор слов в модели, чтобы создать статистическую закономерность, которую позже можно будет обнаружить», согласно отчету BleepingComputer. Водяной знак невидим при чтении или копировании текста, и OpenAI утверждает, что он не ухудшает качество вывода.

Сторона обнаружения намеренно ограничена. Наряду с запуском водяных знаков OpenAI открывает приложения для своего детектора водяных знаков, но первоначально доступ будет ограничен одобренными исследователями и экспертными организациями. Такая конструкция защищает возможность обнаружения от тех, кто надеется использовать ее в качестве оружия, но это также означает, что издатели, преподаватели и работодатели не могут независимо проверить, имеет ли тот или иной фрагмент текста водяные знаки.

Доступ к API доступен по всему миру

Мандат ЕС распространяется на результаты ChatGPT и Codex в блоке, но OpenAI одновременно дает разработчикам во всем мире выбор. Начиная с 5 октября разработчики API по всему миру смогут включить использование текстовых водяных знаков для поддерживаемых моделей. Эта функция остается отключенной по умолчанию в API, и это решение New Stack подчеркивает как контраст с подходом Anthropic, который в начале этого года включил маркировку происхождения для трафика из ЕС в ответ на те же правила.

Такое согласие успокоит разработчиков, обеспокоенных непредвиденными побочными эффектами. Статистические водяные знаки меняют способ выборки токенов, и любая модификация генерации несет в себе, по крайней мере, теоретический риск изменения поведения в крайних случаях. Сделав водяные знаки флагом, а не значением по умолчанию, OpenAI передает решение о соответствии требованиям компаниям, использующим ее модели.

Почему Закон ЕС об искусственном интеллекте вынудил это сделать

Положения Закона ЕС об искусственном интеллекте требуют, чтобы текст, сгенерированный искусственным интеллектом, можно было идентифицировать как сгенерированный машиной, и это обязательство подтолкнуло как OpenAI, так и Anthropic к использованию статистических схем водяных знаков. В сообщении в блоге OpenAI textGrain рассматривается как реализация этих требований к происхождению, а PYMNTS сообщил, что развертывание напрямую соответствует требованиям OpenAI «Закона ЕС об искусственном интеллекте».

Время примечательно. Объявление о «водяном знаке» прозвучало на фоне необычно бурного периода для публичной позиции OpenAI: тот же цикл новостей привел к уходу руководителя по безопасности Дэвида Робинсона, расследованию Федеральной торговой комиссии потребительских рисков в крупных лабораториях искусственного интеллекта и атмосфере судебных исков акционеров, которые держали компанию под пристальным вниманием. Использование водяных знаков — одно из немногих нормативных требований, которые OpenAI может полностью удовлетворить за счет инфраструктуры, а не изменений продукта, что может объяснить, почему он был выпущен первым.

Подвох: водяные знаки ломаются при редактировании

OpenAI сам по себе признает фундаментальное ограничение. Компания признает, что ее водяной знак может исчезнуть при редактировании текста, и десятилетия исследований в области лингвистической стеганографии подтверждают эту обеспокоенность: перефразирование, перевод или даже скромное переписывание могут уничтожить статистические водяные знаки. Любой, кто решит отмыть текст ИИ с помощью инструмента «гуманизатора», скорее всего, преуспеет.

Эта слабость не помешала регулирующим органам требовать наличия водяных знаков, а лабораториям не помешала их поставлять. Реалистичная цель заключается не в обеспечении защиты от несанкционированного доступа, а в повышении стоимости случайного обмана в больших масштабах – та же логика, которая управляет водяными знаками на валюте. Критики, в том числе некоторые группы по безопасности ИИ, которые скептически относятся к добровольным отраслевым мерам, утверждают, что детекторы, доступные только одобренным организациям, мало что делают для учителей, редакторов или платформ, пытающихся обеспечить соблюдение своей собственной политики в отношении ИИ-контента.

Что это значит для пользователей и разработчиков

Для пользователей ChatGPT и Codex внутри ЕС ничего не изменится. Текст будет выглядеть и восприниматься одинаково, а на выходных данных не будет никаких меток. Водяной знак просто будет присутствовать, и в принципе его смогут обнаружить одобренные партнеры OpenAI.

Для разработчиков флаг API появляется сразу, и его стоит тщательно оценить: его включение означает принятие небольших изменений в выборке токенов при каждом завершении, даже для пользователей, не входящих в ЕС, поскольку настройка API является глобальной. Команды со строгими бюджетами на задержку или качество, возможно, захотят сравнить генерацию водяных знаков с их текущими настройками, прежде чем переключать переключатель.

OpenAI сообщает, что более подробная информация о подходящих моделях и процессе применения детектора появится в ближайшие недели. Поскольку другие лаборатории сталкиваются с теми же обязательствами ЕС, textGrain вряд ли станет последней схемой нанесения водяных знаков, которую отрасль развернет в этом году.

Будьте впереди ИИ

Регулирование меняет то, как работают продукты искусственного интеллекта. [Получайте последние разработки в области искусственного интеллекта на AI Buzz Wire] (https://aibuzzwire.news), где анализ политики и новости моделей обновляются в течение дня.

Больше новостей об искусственном интеллекте можно прочитать здесь.