OpenAI mengumumkan pada tanggal 5 Oktober bahwa mereka akan mulai menambahkan tanda air tak kasat mata pada teks yang dihasilkan oleh ChatGPT dan Codex untuk pengguna di Uni Eropa, sebagai respons konkrit terhadap aturan asal teks UU AI UE. Dalam postingan blog berjudul "Pendekatan kami terhadap aturan asal teks UE", perusahaan tersebut mengatakan bahwa watermarking akan diluncurkan "dalam beberapa minggu mendatang" untuk keluaran yang memenuhi syarat di blok tersebut, sebuah rencana yang dilaporkan pada hari yang sama oleh TechCrunch, The Verge, BleepingComputer, Engadget, dan outlet lainnya.

Teknologi di balik perubahan ini disebut textGrain. Daripada menyematkan tanda yang terlihat, textGrain bekerja dengan mengarahkan pilihan kata model secara halus sehingga teks yang dihasilkan membawa pola statistik yang nantinya dapat dideteksi. Pembaca tidak akan menyadari apa pun saat membaca atau menyalin teks yang dihasilkan AI; deteksi memerlukan akses ke detektor OpenAI, yang tidak tersedia untuk masyarakat umum. Untuk melihat secara lebih luas bagaimana regulator dan laboratorium saling bertentangan dalam aturan AI, ikuti liputan kebijakan AI kami yang sedang berlangsung.

Cara Kerja TextGrain Watermarking

Pendekatan OpenAI mengubah proses pemilihan token selama pembuatan. Perusahaan tersebut mengatakan textGrain "sedikit mengubah pilihan kata model untuk menciptakan pola statistik yang nantinya dapat dideteksi," menurut laporan dari BleepingComputer. Tanda air tidak terlihat saat teks dibaca atau disalin, dan OpenAI mengklaim hal itu tidak menurunkan kualitas keluaran.

Sisi pendeteksiannya sengaja dibatasi. Bersamaan dengan peluncuran watermark, OpenAI juga membuka aplikasi untuk pendeteksi watermarknya, namun akses pada awalnya akan dibatasi pada peneliti dan organisasi ahli yang disetujui. Desain tersebut membuat kemampuan pendeteksian tidak dapat dijangkau oleh siapa pun yang ingin menggunakannya sebagai senjata, namun hal ini juga berarti penerbit, guru, dan perusahaan tidak dapat secara independen memverifikasi apakah suatu teks diberi watermark.

Akses API Diikutsertakan di Seluruh Dunia

Mandat UE berlaku untuk ChatGPT dan keluaran Codex di blok tersebut, namun OpenAI secara bersamaan memberikan pilihan kepada pengembang di mana pun. Mulai tanggal 5 Oktober, pengembang API di seluruh dunia dapat ikut serta dalam pemberian tanda air teks untuk model yang didukung. Fitur ini tetap dinonaktifkan secara default di API, sebuah keputusan yang disoroti oleh The New Stack sebagai kontras dengan pendekatan Anthropic, yang mengaktifkan penandaan asal untuk lalu lintas UE awal tahun ini sebagai tanggapannya terhadap aturan yang sama.

Sikap keikutsertaan ini akan meyakinkan pengembang tentang kekhawatiran akan efek samping yang tidak terduga. Watermarking statistik mengubah cara pengambilan sampel token, dan modifikasi apa pun pada pembuatannya setidaknya membawa risiko teoritis berupa perubahan perilaku pada kasus-kasus edge. Dengan menjadikan watermarking sebagai sebuah bendera, bukan sebagai default, OpenAI mengalihkan keputusan kepatuhan kepada perusahaan yang mengembangkan modelnya.

Mengapa Undang-Undang AI UE Memaksa Hal Ini

Ketentuan transparansi UU AI UE mengharuskan teks yang dihasilkan AI dapat diidentifikasi sebagai buatan mesin, sebuah kewajiban yang mendorong OpenAI dan Anthropic menuju skema watermarking statistik. Posting blog OpenAI membingkai textGrain sebagai implementasinya terhadap persyaratan asal tersebut, dan PYMNTS melaporkan peluncuran tersebut sebagai pertemuan OpenAI "mandat UU AI UE" secara langsung.

Waktunya sangat penting. Pengumuman watermark ini muncul di tengah gejolak yang tidak biasa pada sikap publik OpenAI: siklus berita yang sama menyebabkan kepergian pemimpin keselamatan David Robinson, penyelidikan FTC terhadap risiko konsumen di laboratorium AI besar, dan suasana tuntutan hukum pemegang saham yang membuat perusahaan ini terus diawasi. Watermarking adalah salah satu dari sedikit tuntutan peraturan yang dapat dipenuhi OpenAI sepenuhnya dengan infrastruktur dibandingkan dengan perubahan produk, yang mungkin menjelaskan mengapa OpenAI dikirimkan terlebih dahulu.

Tangkapan: Tanda Air Rusak Saat Diedit

OpenAI sendiri mengakui keterbatasan mendasar. Perusahaan tersebut mengakui bahwa tanda airnya dapat hilang ketika teks diedit, dan penelitian selama puluhan tahun mengenai steganografi linguistik mendukung kekhawatiran tersebut: parafrase, terjemahan, atau bahkan penulisan ulang yang sederhana dapat merusak tanda air statistik. Siapa pun yang bertekad untuk mencuci teks AI melalui alat "humanizer" kemungkinan besar akan berhasil.

Kelemahan tersebut tidak menghentikan regulator untuk mewajibkan pemberian watermarking, dan tidak menghentikan laboratorium untuk mengirimkannya. Sasaran realistisnya bukanlah asal usul yang tahan terhadap kerusakan, namun meningkatkan kerugian akibat penipuan dalam skala besar, logika yang sama yang mengatur tanda air mata uang. Kritikus, termasuk beberapa kelompok keamanan AI yang skeptis terhadap tindakan sukarela industri, berpendapat bahwa detektor yang hanya dapat diakses oleh organisasi yang disetujui tidak banyak membantu guru, editor, atau platform yang mencoba menegakkan kebijakan konten AI mereka sendiri.

Apa Artinya bagi Pengguna dan Pengembang

Untuk pengguna ChatGPT dan Codex di UE, tidak ada perubahan yang terlihat. Teks akan terlihat dan terasa sama, dan tidak ada label yang muncul pada keluaran. Tanda air hanya akan ada di sana, dan pada prinsipnya dapat dideteksi oleh mitra OpenAI yang disetujui.

Bagi pengembang, tanda API segera hadir dan patut dievaluasi dengan hati-hati: mengaktifkannya berarti menerima perubahan halus pada pengambilan sampel token di setiap penyelesaian, bahkan untuk pengguna non-UE, karena pengaturan API bersifat global. Tim dengan latensi ketat atau anggaran berkualitas mungkin ingin membandingkan pembuatan watermark dengan penyiapan mereka saat ini sebelum beralih.

OpenAI mengatakan rincian lebih lanjut tentang model yang memenuhi syarat dan proses aplikasi detektor akan tiba dalam beberapa minggu mendatang. Karena laboratorium lain juga menghadapi kewajiban yang sama di Uni Eropa, textGrain kemungkinan tidak akan menjadi skema watermarking terakhir yang diterapkan industri ini pada tahun ini.

Tetap Terdepan dalam AI

Regulasi mengubah cara kerja produk AI. Dapatkan perkembangan AI terkini di AI Buzz Wire, dengan analisis kebijakan dan berita model yang diperbarui sepanjang hari.

Baca berita AI selengkapnya di sini.