Memandangkan media yang dijana AI membanjiri internet, teknologi penanda air SynthID Google telah muncul sebagai salah satu alat yang paling menonjol untuk membezakan kandungan tulen daripada imejan sintetik. Ujian tekanan baharu yang ketat mengesahkan tera air halimunan itu sangat tahan lasak, bertahan dalam ratusan pusingan pemampatan, saiz semula dan juga tangkapan skrin, tetapi hasilnya juga menggariskan kebenaran yang lebih sukar: label teknikal sahaja tidak mungkin menyelesaikan krisis maklumat palsu AI yang semakin meningkat. Untuk pelaporan berterusan tentang perkembangan AI terkini, penemuan itu menandakan titik pemeriksaan penting dalam perbahasan asal kandungan.

Skala masalah sukar untuk dilebih-lebihkan. Starling Lab, kerjasama penyelidikan antara Universiti Stanford dan Universiti California Selatan, menganggarkan bahawa ia mengambil masa sehingga 1975, 149 tahun selepas penciptaan kamera, untuk manusia menghasilkan 1.5 bilion imej. AI Generatif memadankan output itu dalam masa 18 bulan sahaja. Pada persidangan I/O tahun ini, Google mengumumkan bahawa alatnya sahaja telah digunakan untuk mencipta lebih daripada 100 bilion imej dan video AI dalam beberapa tahun.

Cara SynthID Berfungsi

Pada masa ini terdapat dua pendekatan utama untuk melabelkan kandungan yang dijana AI: tera air halimunan seperti SynthID dan skema metadata seperti piawaian Gabungan untuk Keaslian dan Ketulenan Kandungan (C2PA). Google menggunakan kedua-duanya. C2PA adalah selamat dari segi kriptografi dan tidak boleh dipalsukan, tetapi ia adalah mudah untuk dilucutkan. Hanya mengedit dan menyimpan imej, atau mengambil tangkapan skrin, boleh mengalih keluar metadata C2PA sepenuhnya.

SynthID mengambil pendekatan yang berbeza. Daripada bergantung pada metadata yang terletak di sebelah fail, tera air dikodkan terus ke dalam piksel imej atau video atau ke dalam bentuk gelombang klip audio. Oleh kerana isyarat itu dijalin ke dalam kandungan itu sendiri, Google berpendapat bahawa ia harus bertahan daripada transformasi, pemampatan, pemangkasan dan pengekodan semula yang berlaku secara semula jadi apabila media disebarkan di seluruh internet.

Ujian Tekanan untuk Isyarat Tahap Piksel

Ars Technica meletakkan tuntutan tersebut untuk ujian menggunakan skrip Python yang dibina pada perpustakaan pengimejan Bantal. Skrip simulasi kehilangan data daripada perkongsian berulang dan muat turun pada kadar yang sangat dipercepatkan, menggunakan mampatan rawak dan mengubah saiz nilai pada imej ujian dan memasukkan semula setiap output sebagai asas untuk lelaran seterusnya. Dua imej yang dijana AI daripada model Nano Banana Pro Google, satu dicipta sepenuhnya dari awal dan satu foto asal yang diedit oleh AI, berfungsi sebagai subjek ujian.

Selepas 300 generasi perkongsian simulasi, di mana asal yang jelas telah didegradasi menjadi gumpalan yang hampir tidak dapat dikenali, tera air SynthID masih didaftarkan pada kedua-dua imej. Tera air malah terselamat daripada tangkapan skrin penuh, kerana piksel penanda khas dipindahkan ke fail baharu. Setiap 50 generasi penguji juga menghasilkan versi yang dipangkas untuk melemahkan pengesanan lagi.

Tempat SynthID Akhirnya Putus

Had teknologi hanya muncul dalam keadaan yang melampau. Selepas 300 kitaran mampatan, mengalih keluar segelintir piksel dari sempadan imej ujian yang terdegradasi akhirnya memecahkan SynthID pada kedua-dua imej yang dijana sepenuhnya dan imej yang diedit AI. Oleh kerana isyarat tera air diedarkan ke seluruh piksel, ia menentang pemangkasan kasual, tetapi apabila degradasi yang mencukupi terkumpul, pengesan boleh dikalahkan.

Saintis Google DeepMind Pushmeet Kohli memberitahu Ars bahawa pasukan itu mereka bentuk sistem menjangkakan ia akan diserang. "Melalui keseluruhan proses pembangunan, kami mengandaikan bahawa teknologi seperti ini akan diserang," kata Kohli. "Jadi kami melakukan banyak penyelidikan dalam menjadikan SynthID teguh kepada pelbagai jenis transformasi. Sama ada orang menambah beberapa jenis penapis atau memangkas imej, kami menggunakan transformasi ini dan memastikan pengesan itu kukuh terhadapnya."

Tera Air Berkembang Merentasi Industri

Ujian tiba apabila penggunaan SynthID semakin meluas melangkaui produk Google sendiri. Syarikat itu telah menjalin kerjasama untuk meluaskan penggunaan tera air, dengan OpenAI, Runway, dan Nvidia antara mereka yang mula menyepadukan teknologi ke dalam alatan generatif mereka. Google telah keberatan untuk mengeluarkan banyak butiran teknikal di luar kertas penyelidikan asal, itulah sebabnya ujian bebas jenis Ars yang dijalankan adalah penting apabila tera air berkembang merentasi landskap AI.

Label Sahaja Tidak Cukup

Ketegangan utama yang didedahkan oleh eksperimen ialah walaupun tera air yang teguh hanya berguna seperti kesediaan platform dan orang ramai untuk menyemaknya. Pengesanan SynthID belum lagi dibina secara meluas ke dalam rangkaian sosial dan apl pemesejan di mana kebanyakan media yang dimanipulasi sebenarnya tersebar. Tera air yang bertahan dalam 300 kitaran mampatan menawarkan sedikit perlindungan jika tiada sesiapa di bahagian penerima yang mengimbasnya.

Hasil ketahanan adalah benar-benar menggalakkan untuk bidang ketulenan kandungan. Mereka mencadangkan bahawa penanda air tahap piksel yang tidak kelihatan boleh berfungsi sebagai tulang belakang teknikal yang boleh dipercayai untuk asal. Tetapi persoalan yang lebih luas, sama ada masyarakat boleh membina norma, infrastruktur dan insentif untuk benar-benar bertindak atas isyarat tersebut, masih tidak dapat diselesaikan. Memandangkan jumlah media sintetik terus meningkat melepasi pencapaian 100 bilion imej, jurang antara perkara yang boleh ditandakan oleh teknologi dan platform yang akan menjadi sederhana menjadi cabaran yang menentukan.

Kekal Mendahului AI

Ikuti perkembangan berita terbaharu AI membentuk dasar, penyelidikan dan platform yang membentuk semula internet.

Baca lebih banyak berita AI