Pangembang AI sing unggul ing China wis ngumumake asil tes safety khusus model kanggo mung bagean cilik saka rilis, miturut laporan dening firma riset SemiAnalysis, amarga kuwatir babagan risiko sing ditimbulake dening sistem AI canggih mundhak ing saindenging jagad.
Temuan kasebut, sing dilapurake dening Reuters, ngitung jurang transparansi ing jantung debat keamanan AI global: laboratorium sing mbangun sawetara model sing paling mumpuni ing donya arang banget nerbitake asil evaluasi sing bisa diikat wong njaba menyang model tartamtu. For more context on this story, see our ongoing more AI stories.
Apa Laporan Dipriksa
SemiAnalysis berbasis California, perusahaan riset teknologi, nyemak 857 model sing dirilis antarane 2021 nganti 15 September dening sangang perusahaan AI China sing misuwur: Alibaba, ByteDance, Tencent, Baidu, DeepSeek, Moonshot, Z.AI, MiniMax lan StepFun.
Ditemokake manawa 31 rilis - utawa 3,6% - duwe asil evaluasi safety sing diterbitake sing bisa dicocogake karo model tartamtu. Mung sangang, utawa 1.1%, duwe asil kasebut kasedhiya ing utawa sadurunge diluncurake. Peneliti ora nemokake pambocoran keamanan kanggo 813 rilis, sanajan laporan kasebut nyathet manawa perusahaan bisa nindakake tes kanthi pribadi tanpa nerbitake.
Bar kanggo ngitung pambocoran sengaja ketat. SemiAnalysis ditetepake minangka asil tartamtu sing ana gandhengane karo model sing dijenengi - kalebu tes output sing mbebayani, resistensi jailbreak, keracunan, privasi, prilaku nolak utawa kemampuan mbebayani. Klaim umum manawa model wis dilatih safety utawa dievaluasi ora dianggep.
Napa Nomer Penting Saiki
Laporan kasebut teka ing tengah-tengah debat intensif babagan agen AI otonom - sistem sing nindakake tugas multistep kanthi campur tangan manungsa sing winates. Kedadeyan keamanan sing nglibatake agen kasebut wis ngunggahake pitakon babagan safety-versus-speed kanggo pangembang ing Amerika Serikat lan China.
Umume model AI sing bisa nguwasani agen sing bisa nindakake pelanggaran cyber kanthi otonom digawe dening pangembang AS utawa China, mula praktik transparansi ing ekosistem China diawasi kanthi rapet ing luar negeri. Australia ujar wulan kepungkur yen agen OpenAI nglanggar portal kesehatan pemerintah, lan Reuters nglaporake minggu kepungkur manawa agen AI China wis nuduhake kemampuan kanggo ngapusi pangguna, nyingkiri larangan lan ndhelikake kegagalan ing tes - nyatakake keprihatinan sadurunge babagan sistem AS sing maju.
Apa Sajatine Aturan Tionghoa Dibutuhake
China duwe AI Safety Governance Framework - versi paling anyar ngenali risiko kalebu model sing entuk ijin sistem utawa sumber daya eksternal tanpa wewenang, ngapusi evaluator, ndhelikake kemampuan lan ngliwati kontrol safety. Nanging miturut SemiAnalysis, kerangka kasebut ora ngetrapake tugas wajib sing ana gandhengane karo kemampuan model.
Aturan naleni Beijing utamane ngatur aplikasi lan pengaruhe marang pangguna, ujare laporan kasebut, tinimbang mbutuhake pangembang perbatasan kanggo nindakake utawa nerbitake penilaian risiko adhedhasar kapabilitas model. Kanthi tembung liyane, penekanan regulasi yaiku babagan cara produk AI tumindak ing pasar, dudu babagan evaluasi pra-rilis model kasebut.
Laporan kasebut nambahake manawa ora ana pangembang Cina sing ngluncurake model teks perbatasan kanthi tes kemampuan mbebayani sing diungkapake sacara umum babagan risiko cyber, biologis lan kelangan kontrol - kategori sing ditindakake dening lembaga keamanan Barat minangka patokan kanggo evaluasi perbatasan.
Masalah Perbandingan
Siji watesan sing penting: laporan kasebut ora menehi angka sing padha kanggo pangembang AI AS, saengga angka 3,6% ora bisa diwaca minangka kertu skor China-versus-Amerika. Perusahaan AS sing unggul kalebu OpenAI, Anthropic lan Google DeepMind wis nerbitake laporan keamanan, kertu sistem utawa kertu model kanggo sawetara peluncuran model perbatasan utama - nanging pambocoran kasebut uga cenderung nutupi model unggulan, dudu volume rilis lengkap, lan peneliti independen wis suwe mbantah manawa praktik pambocoran AS uga ora konsisten.
Asimetri kasebut ndadekake kontribusi pusat laporan luwih jelas: luwih murah tinimbang metodologi. Kanthi mbutuhake asil sing cocog karo model sing dijenengi, SemiAnalysis nawakake cithakan sing bisa ditrapake kanggo pangembang negara - lan pangeling-eling manawa klaim keamanan paling akeh ing industri kasebut, saka ngendi wae, ora bisa diverifikasi marang release tartamtu.
Apa Kelakon Sabanjure
Temuan kasebut dadi debat kabijakan langsung ing loro-lorone Pasifik. Ing AS, anggota parlemen nimbang standar AI federal, syarat pambocoran lan aturan keamanan kanggo model perbatasan, dene legislatif negara wis ngetrapake tagihan transparan dhewe. Ing China, regulator wis ngencengi aturan kanggo aplikasi AI, kalebu kontrol konten AI generatif, nanging tugas evaluasi sing ana gandhengane karo kemampuan kanggo pangembang perbatasan tetep kanthi sukarela ing praktik.
Kanggo komunitas safety AI, angka kasebut menehi wujud konkrit kanggo keluhan sing asring digawe ing abstrak: yen evaluasi paling penting ing lapangan kedadeyan ing mburi lawang sing ditutup. Apa obah tingkat pambocoran - ing China utawa ing ngendi wae - bisa uga ora gumantung karo norma riset tinimbang apa pamrentah wiwit nggawe uji pra-rilis minangka syarat hukum tinimbang pilihan siaran pers.
Sanadyan laporan SemiAnalysis utawa Reuters nulis-up nuduhake yen sangang perusahaan dijaluk nanggapi individu; perusahaan bisa, mesthi, terus program testing internal sing mung ora diterbitake.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →