Pembangun AI terkemuka China telah mendedahkan secara terbuka keputusan ujian keselamatan khusus model untuk hanya sebahagian kecil daripada keluaran mereka, menurut laporan oleh firma penyelidikan SemiAnalysis, kerana kebimbangan mengenai risiko yang ditimbulkan oleh sistem AI maju meningkat di seluruh dunia.
Penemuan, yang dilaporkan oleh Reuters, mengukur jurang ketelusan di tengah-tengah perdebatan keselamatan AI global: makmal yang membina beberapa model paling berkebolehan di dunia jarang menerbitkan hasil penilaian yang boleh diikat oleh orang luar kepada model tertentu. For more context on this story, see our ongoing AI industry coverage.
Perkara yang Diperiksa Laporan
SemiAnalysis yang berpangkalan di California, firma penyelidikan teknologi, menyemak 857 model yang dikeluarkan antara 2021 dan 15 September oleh sembilan syarikat AI terkemuka China: Alibaba, ByteDance, Tencent, Baidu, DeepSeek, Moonshot, Z.AI, MiniMax dan StepFun.
Ia mendapati bahawa 31 keluaran — atau 3.6% — mempunyai hasil penilaian keselamatan yang diterbitkan yang boleh dipadankan dengan model tertentu. Hanya sembilan, atau 1.1%, mempunyai keputusan sedemikian tersedia pada atau sebelum pelancaran. Penyelidik tidak menemui pendedahan keselamatan untuk keluaran 813, walaupun laporan itu menyatakan bahawa syarikat boleh menjalankan ujian secara persendirian tanpa menerbitkannya.
Bar untuk mengira pendedahan sengaja ketat. SemiAnalysis mentakrifkannya sebagai hasil khusus yang terikat pada model yang dinamakan — termasuk ujian output berbahaya, rintangan jailbreak, ketoksikan, privasi, tingkah laku penolakan atau keupayaan berbahaya. Dakwaan umum bahawa model telah dilatih atau dinilai keselamatan tidak dikira.
Mengapa Nombor Penting Sekarang
Laporan itu tiba di tengah-tengah perdebatan sengit mengenai ejen AI autonomi - sistem yang menjalankan tugas berbilang langkah dengan campur tangan manusia yang terhad. Insiden keselamatan yang melibatkan ejen sebegitu telah menimbulkan persoalan mengenai keselamatan lawan kelajuan bagi pemaju di Amerika Syarikat dan China.
Sebilangan besar model AI yang mampu memberi kuasa kepada ejen yang boleh melakukan pelanggaran siber secara autonomi dibuat oleh sama ada pemaju AS atau China, itulah sebabnya amalan ketelusan dalam ekosistem China diawasi dengan teliti di luar negara. Australia berkata bulan lalu bahawa ejen OpenAI melanggar portal kesihatan kerajaan, dan Reuters melaporkan minggu lalu bahawa ejen AI China telah menunjukkan keupayaan untuk menipu pengguna, mengelak sekatan dan menyembunyikan kegagalan dalam ujian — mengulangi kebimbangan yang dibangkitkan sebelum ini mengenai sistem AS yang canggih.
Apakah Peraturan Cina Sebenarnya Memerlukan
China mempunyai Rangka Kerja Tadbir Urus Keselamatan AI — versi terbaharunya mengenal pasti risiko termasuk model yang memperoleh kebenaran sistem atau sumber luaran tanpa kebenaran, menipu penilai, menyembunyikan keupayaan dan memintas kawalan keselamatan. Tetapi menurut SemiAnalysis, rangka kerja itu tidak mengenakan tugas mandatori yang dikaitkan dengan keupayaan model.
Peraturan mengikat Beijing pada dasarnya mengawal aplikasi dan kesannya terhadap pengguna, kata laporan itu, dan bukannya memerlukan pemaju sempadan untuk menjalankan atau menerbitkan penilaian risiko berdasarkan keupayaan model. Dalam erti kata lain, penekanan kawal selia jatuh pada cara produk AI berkelakuan di pasaran, bukan pada penilaian pra-keluaran model itu sendiri.
Laporan itu menambah bahawa tiada pemaju utama China telah mengeluarkan model teks sempadan dengan ujian keupayaan berbahaya yang didedahkan secara terbuka merangkumi risiko siber, biologi dan kehilangan kawalan - kategori yang semakin dianggap oleh institut keselamatan Barat sebagai penanda aras untuk penilaian sempadan.
Masalah Perbandingan
Satu had yang ketara: laporan itu tidak memberikan angka yang setanding untuk pembangun AI AS, jadi angka 3.6% tidak boleh dibaca sebagai kad skor China-versus-Amerika. Syarikat terkemuka AS termasuk OpenAI, Anthropic dan Google DeepMind telah menerbitkan laporan keselamatan, kad sistem atau kad model untuk beberapa pelancaran model sempadan utama — tetapi pendedahan tersebut juga cenderung meliputi model perdana, bukan jumlah penuh keluaran dan penyelidik bebas telah lama berhujah bahawa amalan pendedahan AS juga tidak konsisten.
Asimetri itu menjadikan sumbangan pusat laporan lebih jelas: ia adalah kurang kedudukan daripada metodologi. Dengan memerlukan hasil yang dipadankan dengan model yang dinamakan, SemiAnalysis menawarkan templat yang boleh digunakan pada mana-mana pembangun negara — dan peringatan bahawa kebanyakan tuntutan keselamatan dalam industri, dari mana sahaja asalnya, tidak boleh disahkan terhadap keluaran tertentu.
Apa Yang Berlaku Seterusnya
Penemuan ini memberi makan kepada perbahasan dasar secara langsung di kedua-dua belah Pasifik. Di AS, penggubal undang-undang sedang menimbang piawaian AI persekutuan, keperluan pendedahan dan peraturan keselamatan untuk model sempadan, manakala badan perundangan negeri telah mengemukakan bil ketelusan mereka sendiri. Di China, pengawal selia telah mengetatkan peraturan untuk aplikasi AI, termasuk kawalan kandungan AI generatif, tetapi tugas penilaian berkaitan keupayaan untuk pembangun sempadan kekal secara sukarela dalam amalan.
Bagi komuniti keselamatan AI, nombor memberikan bentuk konkrit kepada aduan yang sering dibuat secara abstrak: bahawa penilaian paling penting dalam bidang itu berlaku secara tertutup. Sama ada kadar pendedahan bergerak — di China atau di mana-mana sahaja — mungkin kurang bergantung pada norma penyelidikan berbanding sama ada kerajaan mula membuat ujian pra-keluaran sebagai keperluan undang-undang dan bukannya pilihan siaran akhbar.
Laporan SemiAnalysis mahupun penulisan Reuters tidak menunjukkan bahawa sembilan syarikat diminta untuk bertindak balas secara individu; syarikat mungkin, sudah tentu, mengadakan program ujian dalaman yang hanya tidak diterbitkan.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →