OpenAI kündigte am 5. Oktober an, dass es mit dem Hinzufügen unsichtbarer Wasserzeichen zu Texten beginnen wird, die von ChatGPT und Codex für Benutzer in der Europäischen Union generiert werden. Dies ist eine konkrete Reaktion auf die Textherkunftsregeln des EU AI Act. In einem Blogbeitrag mit dem Titel „Unser Ansatz zu EU-Textherkunftsregeln“ sagte das Unternehmen, dass die Wasserzeichenmarkierung „in den kommenden Wochen“ für berechtigte Ausgaben im Block eingeführt wird, ein Plan, über den TechCrunch, The Verge, BleepingComputer, Engadget und andere Medien am selben Tag berichteten.

Die Technologie hinter der Änderung heißt textGrain. Anstatt eine sichtbare Markierung einzubetten, steuert textGrain die Wortauswahl des Modells auf subtile Weise, sodass der resultierende Text ein statistisches Muster aufweist, das später erkannt werden kann. Leser werden nichts bemerken, wenn sie KI-generierten Text konsumieren oder kopieren; Für die Erkennung ist der Zugriff auf den Detektor von OpenAI erforderlich, der der Öffentlichkeit nicht zugänglich ist. Um einen umfassenderen Einblick in die Konflikte zwischen Regulierungsbehörden und Laboren bei KI-Regeln zu erhalten, folgen Sie unserer laufenden Berichterstattung über KI-Richtlinien.

So funktioniert textGrain-Wasserzeichen

Der Ansatz von OpenAI modifiziert den Token-Auswahlprozess während der Generierung. Das Unternehmen sagt, dass textGrain „die Wortauswahl des Modells leicht ändert, um ein statistisches Muster zu erstellen, das später erkannt werden kann“, heißt es in einem Bericht von BleepingComputer. Das Wasserzeichen ist unsichtbar, wenn der Text gelesen oder kopiert wird, und OpenAI behauptet, dass es die Ausgabequalität nicht beeinträchtigt.

Die Detektionsseite ist bewusst eingeschränkt. Parallel zur Wasserzeicheneinführung eröffnet OpenAI Anwendungen für seinen Wasserzeichendetektor, der Zugang wird jedoch zunächst auf zugelassene Forscher und Expertenorganisationen beschränkt sein. Dieses Design verhindert, dass die Erkennungsfähigkeit in die Hände derjenigen gelangt, die sie als Waffe einsetzen wollen, bedeutet aber auch, dass Verleger, Lehrer und Arbeitgeber nicht unabhängig überprüfen können, ob ein Textstück mit einem Wasserzeichen versehen ist.

API-Zugriff ist weltweit möglich

Das EU-Mandat gilt für die ChatGPT- und Codex-Ausgabe im Block, aber OpenAI lässt Entwicklern gleichzeitig überall die Wahl. Ab dem 5. Oktober können API-Entwickler weltweit für unterstützte Modelle Textwasserzeichen aktivieren. Die Funktion bleibt auf der API standardmäßig deaktiviert, eine Entscheidung, die The New Stack als Kontrast zum Ansatz von Anthropic hervorhebt, das Anfang des Jahres in seiner eigenen Reaktion auf dieselben Regeln die Herkunftskennzeichnung für den EU-Verkehr aktiviert hat.

Diese Opt-in-Haltung wird Entwickler beruhigen, die sich Sorgen über unvorhergesehene Nebenwirkungen machen. Statistische Wasserzeichen verändern die Art und Weise, wie Token abgetastet werden, und jede Änderung der Generierung birgt zumindest theoretisch das Risiko einer Verhaltensänderung in Grenzfällen. Indem OpenAI das Wasserzeichen zu einem Flag und nicht zu einem Standard macht, überträgt es die Compliance-Entscheidung auf die Unternehmen, die auf seinen Modellen aufbauen.

Warum das EU-KI-Gesetz dies erzwang

Die Transparenzbestimmungen des EU-KI-Gesetzes erfordern, dass KI-generierter Text als maschinengeneriert identifizierbar ist, eine Verpflichtung, die sowohl OpenAI als auch Anthropic zu statistischen Wasserzeichensystemen drängte. Im Blog-Beitrag von OpenAI wird textGrain als Umsetzung dieser Herkunftsanforderungen dargestellt, und PYMNTS berichtete, dass die Einführung durch OpenAI direkt den „Anforderungen des EU-KI-Gesetzes“ entspreche.

Der Zeitpunkt ist bemerkenswert. Die Ankündigung des Wasserzeichens fällt in eine ungewöhnlich turbulente Phase für die öffentliche Haltung von OpenAI: Derselbe Nachrichtenzyklus brachte den Abgang des Sicherheitsführers David Robinson, eine FTC-Untersuchung zu Verbraucherrisiken in großen KI-Laboren und eine Atmosphäre mit Aktionärsklagen, die das Unternehmen unter Beobachtung gehalten hat. Wasserzeichen sind eine der wenigen regulatorischen Anforderungen, die OpenAI vollständig mit der Infrastruktur und nicht mit Produktänderungen erfüllen kann, was möglicherweise erklärt, warum es zuerst ausgeliefert wurde.

Der Haken: Wasserzeichen werden nicht bearbeitet

OpenAI selbst räumt die grundlegende Einschränkung ein. Das Unternehmen räumt ein, dass sein Wasserzeichen verschwinden kann, wenn der Text bearbeitet wird, und jahrzehntelange Forschung zur linguistischen Steganographie bestätigt dieses Problem: Paraphrasierung, Übersetzung oder sogar geringfügiges Umschreiben können statistische Wasserzeichen zerstören. Jeder, der entschlossen ist, KI-Text mithilfe eines „Humanisierungstools“ zu waschen, wird wahrscheinlich Erfolg haben.

Diese Schwäche hat die Regulierungsbehörden nicht davon abgehalten, Wasserzeichen vorzuschreiben, und sie hat Labore nicht davon abgehalten, diese zu versenden. Das realistische Ziel besteht nicht in einer fälschungssicheren Herkunft, sondern darin, die Kosten für zufällige Täuschung in großem Umfang zu erhöhen, die gleiche Logik, die auch für Währungswasserzeichen gilt. Kritiker, darunter einige KI-Sicherheitsgruppen, die freiwilligen Maßnahmen der Industrie skeptisch gegenüberstehen, argumentieren, dass Detektoren, die nur zugelassenen Organisationen zugänglich sind, Lehrern, Redakteuren oder Plattformen, die ihre eigenen KI-Inhaltsrichtlinien durchsetzen wollen, wenig bringen.

Was es für Benutzer und Entwickler bedeutet

Für ChatGPT- und Codex-Benutzer innerhalb der EU wird sich sichtbar nichts ändern. Der Text wird gleich aussehen und sich gleich anfühlen, und auf den Ausgaben wird keine Beschriftung angezeigt. Das Wasserzeichen ist einfach da und im Prinzip für die von OpenAI zugelassenen Partner erkennbar.

Für Entwickler ist das API-Flag sofort verfügbar und es lohnt sich, es sorgfältig zu prüfen: Wenn Sie es aktivieren, müssen Sie geringfügige Änderungen am Token-Sampling bei jedem Abschluss akzeptieren, auch für Nicht-EU-Benutzer, da die API-Einstellung global ist. Teams mit strengen Latenz- oder Qualitätsbudgets möchten möglicherweise die Erzeugung von Wasserzeichen mit ihrem aktuellen Setup vergleichen, bevor sie den Schalter umlegen.

Laut OpenAI werden in den kommenden Wochen weitere Einzelheiten zu den geeigneten Modellen und zum Antragsverfahren für Detektoren bekannt gegeben. Da andere Labore denselben EU-Verpflichtungen unterliegen, wird textGrain wahrscheinlich nicht das letzte Wasserzeichensystem sein, das die Branche in diesem Jahr einsetzt.

Bleiben Sie der KI immer einen Schritt voraus

Die Regulierung verändert die Art und Weise, wie KI-Produkte unter der Haube funktionieren. Erhalten Sie die neuesten KI-Entwicklungen auf AI Buzz Wire, mit den ganzen Tag über aktualisierten Richtlinienanalysen und Modellneuigkeiten.

Lesen Sie hier weitere KI-Neuigkeiten.