5 października OpenAI ogłosiło, że rozpocznie dodawanie niewidocznych znaków wodnych do tekstów generowanych przez ChatGPT i Codex dla użytkowników w Unii Europejskiej, co stanowi konkretną odpowiedź na zasady pochodzenia tekstów zawarte w ustawie UE o sztucznej inteligencji. W poście na blogu zatytułowanym „Nasze podejście do unijnych zasad pochodzenia tekstów” firma podała, że znak wodny zostanie wprowadzony „w nadchodzących tygodniach” dla kwalifikujących się produktów w bloku, zgodnie z planem zgłoszonym tego samego dnia przez TechCrunch, The Verge, BleepingComputer, Engadget i inne punkty sprzedaży.
Technologia stojąca za tą zmianą nazywa się TextGrain. Zamiast osadzać widoczny znak, TextGrain subtelnie steruje wyborem słów w modelu, tak aby wynikowy tekst zawierał wzór statystyczny, który można później wykryć. Czytelnicy nic nie zauważą podczas przeglądania lub kopiowania tekstu wygenerowanego przez sztuczną inteligencję; wykrycie wymaga dostępu do detektora OpenAI, który nie jest dostępny dla ogółu społeczeństwa. Aby uzyskać szersze spojrzenie na konflikty organów regulacyjnych i laboratoriów w sprawie zasad dotyczących sztucznej inteligencji, śledź nasze bieżące informacje na temat zasad dotyczących sztucznej inteligencji.
Jak działa znak wodny TextGrain
Podejście OpenAI modyfikuje proces selekcji tokenów podczas generowania. Według raportu BleepingComputer firma TextGrain „nieznacznie zmienia dobór słów w modelu, tworząc wzór statystyczny, który można później wykryć”. Znak wodny jest niewidoczny podczas czytania lub kopiowania tekstu, a OpenAI twierdzi, że nie pogarsza on jakości wydruku.
Strona wykrywania jest celowo ograniczona. Wraz z wprowadzeniem znaku wodnego OpenAI udostępnia aplikacje dla swojego detektora znaku wodnego, ale dostęp będzie początkowo ograniczony do zatwierdzonych badaczy i organizacji eksperckich. Taka konstrukcja sprawia, że możliwości wykrywania nie są dostępne dla nikogo, kto chciałby je wykorzystać jako broń, ale oznacza to również, że wydawcy, nauczyciele i pracodawcy nie mogą niezależnie sprawdzić, czy fragment tekstu jest opatrzony znakiem wodnym.
Dostęp do API jest opcjonalny na całym świecie
Mandat UE dotyczy wyników ChatGPT i Codex w bloku, ale OpenAI jednocześnie daje programistom na całym świecie wybór. Od 5 października programiści interfejsów API na całym świecie mogą włączyć opcję tekstowego znaku wodnego w obsługiwanych modelach. Ta funkcja pozostaje domyślnie wyłączona w interfejsie API, na tę decyzję The New Stack zwrócił uwagę jako kontrast z podejściem firmy Anthropic, która na początku tego roku włączyła oznaczanie pochodzenia dla ruchu w UE w ramach własnej odpowiedzi na te same zasady.
Taka postawa zgody uspokoi programistów zaniepokojonych nieprzewidzianymi skutkami ubocznymi. Statystyczne znaki wodne zmieniają sposób próbkowania tokenów, a wszelkie modyfikacje generowania niosą ze sobą przynajmniej teoretyczne ryzyko zmiany zachowania w przypadkach brzegowych. Uczyniając znak wodny flagą, a nie domyślną, OpenAI przekazuje decyzję o zgodności firmom budującym na swoich modelach.
Dlaczego wymusiła to unijna ustawa o sztucznej inteligencji
Przepisy dotyczące przejrzystości zawarte w ustawie UE o sztucznej inteligencji wymagają, aby tekst wygenerowany przez sztuczną inteligencję był identyfikowalny jako tekst wygenerowany maszynowo, co popchnęło zarówno OpenAI, jak i Anthropic w stronę statystycznych systemów znakowania wodnego. W poście na blogu OpenAI omówiono tekstGrain jako implementację tych wymagań dotyczących pochodzenia, a PYMNTS poinformowało o wdrożeniu jako bezpośrednio spełniające przez OpenAI „wymagania unijnej ustawy o sztucznej inteligencji”.
Godny uwagi jest czas. Ogłoszenie znaku wodnego następuje w niezwykle burzliwym okresie dla publicznej postawy OpenAI: ten sam cykl wiadomości przyniósł odejście lidera ds. bezpieczeństwa Davida Robinsona, dochodzenie FTC w sprawie zagrożeń dla konsumentów w głównych laboratoriach AI oraz atmosferę pozwów akcjonariuszy, która utrzymywała firmę pod kontrolą. Znak wodny to jeden z niewielu wymogów regulacyjnych, które OpenAI może w pełni spełnić w przypadku zmian w infrastrukturze, a nie w produkcie, co może wyjaśniać, dlaczego pojawiło się jako pierwsze.
Haczyk: znaki wodne psują się podczas edycji
Samo OpenAI przyznaje się do zasadniczego ograniczenia. Firma przyznaje, że znak wodny może zniknąć podczas edycji tekstu, a dziesięciolecia badań nad steganografią językową potwierdzają tę obawę: parafrazowanie, tłumaczenie, a nawet skromne przepisywanie może zniszczyć statystyczne znaki wodne. Każdemu, kto zdecyduje się na pranie tekstu AI za pomocą narzędzia „humanizującego”, prawdopodobnie się to uda.
Ta słabość nie powstrzymuje organów regulacyjnych od wymagania znaku wodnego i nie powstrzymuje laboratoriów od jego wysyłania. Realistycznym celem nie jest zabezpieczenie pochodzenia przed manipulacją, ale zwiększenie kosztów przypadkowego oszustwa na dużą skalę, zgodnie z tą samą logiką, która rządzi znakami wodnymi walut. Krytycy, w tym niektóre grupy zajmujące się bezpieczeństwem sztucznej inteligencji, które były sceptyczne wobec dobrowolnych środków branżowych, argumentują, że detektory dostępne tylko dla zatwierdzonych organizacji niewiele dają nauczycielom, redaktorom i platformom próbującym egzekwować własne zasady dotyczące treści AI.
Co to oznacza dla użytkowników i programistów
Dla użytkowników ChatGPT i Codex w UE nic się nie zmieni w widoczny sposób. Tekst będzie wyglądał i działał tak samo, a na wynikach nie pojawi się żadna etykieta. Znak wodny po prostu tam będzie, w zasadzie wykrywalny przez zatwierdzonych partnerów OpenAI.
Dla programistów flaga API pojawia się natychmiast i warto ją dokładnie ocenić: włączenie jej oznacza akceptację subtelnych zmian w próbkowaniu tokenów przy każdym zakończeniu, nawet w przypadku użytkowników spoza UE, ponieważ ustawienie API jest globalne. Zespoły o ścisłych budżetach na opóźnienia lub jakość mogą chcieć porównać generację znaku wodnego z bieżącą konfiguracją przed zmianą przełącznika.
OpenAI twierdzi, że więcej szczegółów na temat kwalifikujących się modeli i procesu stosowania detektora pojawi się w nadchodzących tygodniach. Ponieważ inne laboratoria mają takie same obowiązki UE, jest mało prawdopodobne, aby TextGrain był ostatnim systemem znaku wodnego wdrożonym w tym roku.
Wyprzedź sztuczną inteligencję
Rozporządzenie zmienia sposób działania produktów AI. Otrzymuj najnowsze informacje o rozwoju sztucznej inteligencji w AI Buzz Wire, gdzie analizy polityki i aktualności dotyczące modeli są aktualizowane przez cały dzień.
Przeczytaj więcej wiadomości o sztucznej inteligencji tutaj.