OpenAI оголосив 5 жовтня, що почне додавати невидимі водяні знаки до тексту, створеного ChatGPT і Codex для користувачів у Європейському Союзі, що є конкретною відповіддю на правила походження тексту Закону ЄС про штучний інтелект. У дописі в блозі під назвою «Наш підхід до правил походження тексту в ЄС» компанія повідомила, що водяні знаки будуть запроваджені «протягом найближчих тижнів» для прийнятної продукції в блоці, про план, який того ж дня повідомили TechCrunch, The Verge, BleepingComputer, Engadget та інші видання.

Технологія зміни називається textGrain. Замість того, щоб вставляти видиму позначку, textGrain працює, тонко керуючи вибором слів моделі, щоб отриманий текст містив статистичну модель, яку можна виявити пізніше. Читачі нічого не помітять під час споживання або копіювання тексту, згенерованого ШІ; для виявлення потрібен доступ до детектора OpenAI, який недоступний для широкого загалу. Щоб ширше поглянути на те, як регулятори та лабораторії стикаються з приводу правил штучного інтелекту, перегляньте нашу поточну політику щодо штучного інтелекту.

Як працює водяний знак textGrain

Підхід OpenAI змінює процес вибору токенів під час генерації. Згідно з повідомленням BleepingComputer, компанія каже, що textGrain «дещо змінює вибір слів у моделі, щоб створити статистичний шаблон, який пізніше можна виявити». Водяний знак невидимий під час читання або копіювання тексту, і OpenAI стверджує, що це не погіршує якість виведення.

Сторона виявлення навмисно обмежена. Разом із запуском водяних знаків, OpenAI відкриває програми для свого детектора водяних знаків, але спочатку доступ буде обмежений для схвалених дослідників та експертних організацій. Завдяки такому дизайну можливості виявлення не потрапляють у руки будь-кого, хто сподівається використати її як зброю, але це також означає, що видавці, викладачі та роботодавці не можуть самостійно перевірити, чи є на фрагменті тексту водяний знак.

Доступ до API доступний у всьому світі

Мандат ЄС стосується вихідних даних ChatGPT і Codex у блоці, але OpenAI водночас надає розробникам будь-де вибір. Починаючи з 5 жовтня, розробники API у всьому світі можуть увімкнути текстові водяні знаки для підтримуваних моделей. Ця функція залишається вимкненою за замовчуванням в API, рішення The New Stack підкреслило як контраст із підходом Anthropic, який увімкнув маркування походження для трафіку з ЄС на початку цього року у відповідь на ті самі правила.

Така позиція дозволу заспокоїти розробників, які хвилюються про непередбачені побічні ефекти. Статистичні водяні знаки змінюють спосіб вибірки токенів, і будь-яка модифікація генерації несе принаймні теоретичний ризик зміни поведінки на граничних випадках. Роблячи водяний знак прапором, а не типовим, OpenAI передає рішення щодо відповідності компаніям, які створюють його моделі.

Чому закон ЄС про штучний інтелект примусив це зробити

Положення про прозорість Закону ЄС про штучний інтелект вимагають, щоб текст, згенерований штучним інтелектом, можна було ідентифікувати як створений машиною, що підштовхнуло як OpenAI, так і Anthropic до схем статистичних водяних знаків. Повідомлення в блозі OpenAI визначає textGrain як реалізацію цих вимог щодо походження, а PYMNTS повідомив про розгортання як те, що OpenAI безпосередньо відповідає «мандатам Закону ЄС про штучний інтелект».

Час помітний. Оголошення про створення водяного знака відбувається на тлі надзвичайно бурхливого періоду для публічної позиції OpenAI: той самий цикл новин приніс відставку керівника безпеки Девіда Робінсона, розслідування FTC про ризики для споживачів у великих лабораторіях ШІ та атмосферу судового позову акціонерів, яка тримала компанію під пильною увагою. Водяні знаки є однією з небагатьох нормативних вимог, які OpenAI може повністю задовольнити за допомогою інфраструктури, а не змін продукту, що може пояснити, чому він був відправлений першим.

Заковика: водяні знаки ламаються під час редагування

OpenAI сам визнає фундаментальне обмеження. Компанія визнає, що її водяний знак може зникнути під час редагування тексту, і десятиліття досліджень лінгвістичної стеганографії підтверджують цю проблему: перефразування, переклад або навіть скромне переписування можуть знищити статистичні водяні знаки. Будь-хто, хто вирішив відмити текст штучного інтелекту за допомогою інструменту «гуманізатора», швидше за все, досягне успіху.

Ця слабкість не завадила регулюючим органам вимагати нанесення водяних знаків, а лабораторіям це не завадило постачати їх. Реалістичною метою є не захист від підробки, а збільшення вартості випадкового обману в масштабах, за тією ж логікою, що керує валютними водяними знаками. Критики, включно з деякими групами безпеки штучного інтелекту, які скептично ставилися до добровільних галузевих заходів, стверджують, що детектори, доступні лише схваленим організаціям, мало допомагають вчителям, редакторам або платформам, які намагаються забезпечити виконання власної політики щодо вмісту штучного інтелекту.

Що це означає для користувачів і розробників

Для користувачів ChatGPT і Codex всередині ЄС нічого помітно не зміниться. Текст виглядатиме та відчуватиметься так само, а на виходах не з’являтиметься мітка. Водяний знак просто буде там, і його, як правило, зможуть виявити схвалені партнери OpenAI.

Для розробників прапор API з’являється негайно, і його варто ретельно оцінити: його ввімкнення означає прийняття тонких змін до вибірки маркерів під час кожного завершення, навіть для користувачів за межами ЄС, оскільки налаштування API є глобальними. Команди зі строгою затримкою або бюджетом якості можуть захотіти порівняти генерацію водяних знаків із поточними налаштуваннями, перш ніж натиснути перемикач.

OpenAI повідомляє, що більш детальна інформація про придатні моделі та процес застосування детектора надійде найближчими тижнями. Оскільки інші лабораторії стикаються з тими ж зобов’язаннями ЄС, textGrain навряд чи буде останньою схемою водяних знаків, яку індустрія розгортає цього року.

Будьте попереду ШІ

Регулювання змінює роботу продуктів ШІ під капотом. Отримайте останні розробки AI на AI Buzz Wire, з аналізом політики та новинами про моделі, які оновлюються протягом дня.

Більше новин AI читайте тут.