Principalii dezvoltatori de inteligență artificială din China au dezvăluit public rezultatele testelor de siguranță specifice modelului pentru doar o mică parte din versiunile lor, potrivit unui raport al firmei de cercetare SemiAnalysis, pe măsură ce preocupările legate de riscurile prezentate de sistemele avansate de inteligență artificială cresc la nivel mondial.
Descoperirile, raportate de Reuters, cuantifică un decalaj de transparență în centrul dezbaterii globale privind siguranța AI: laboratoarele care construiesc unele dintre cele mai capabile modele din lume publică rareori rezultate ale evaluărilor pe care străinii le pot lega de un anumit model. For more context on this story, see our ongoing artificial intelligence updates.
Ce a examinat raportul
SemiAnalysis, o firmă de cercetare tehnologică cu sediul în California, a analizat 857 de modele lansate între 2021 și 15 septembrie de nouă companii chineze de IA: Alibaba, ByteDance, Tencent, Baidu, DeepSeek, Moonshot, Z.AI, MiniMax și StepFun.
A constatat că 31 de lansări – sau 3,6% – au avut un rezultat publicat de evaluare a siguranței care ar putea fi corelat cu un anumit model. Doar nouă, sau 1,1%, au avut astfel de rezultate disponibile la sau înainte de lansare. Cercetătorii nu au găsit nicio dezvăluire de siguranță pentru 813 versiuni, deși raportul notează că companiile ar fi putut efectua teste în mod privat fără a le publica.
Bara pentru numărarea unei dezvăluiri a fost în mod deliberat strictă. SemiAnalysis a definit-o ca rezultate specifice legate de un model numit - inclusiv teste de ieșire dăunătoare, rezistență la jailbreak, toxicitate, confidențialitate, comportament de refuz sau capabilități periculoase. Afirmațiile generale că un model a fost instruit sau evaluat în materie de siguranță nu au luat în considerare.
De ce contează numerele acum
Raportul vine pe fondul unei dezbateri intense asupra agenților AI autonomi - sisteme care îndeplinesc sarcini în mai mulți pași cu intervenție umană limitată. Incidentele de securitate care implică astfel de agenți au ridicat mizele problemei de siguranță versus viteză pentru dezvoltatorii atât din Statele Unite, cât și din China.
Marea majoritate a modelelor de inteligență artificială capabile să alimenteze agenții care ar putea efectua în mod autonom încălcări cibernetice sunt realizate fie de dezvoltatori americani, fie de chinezi, motiv pentru care practicile de transparență din ecosistemul Chinei sunt urmărite îndeaproape în străinătate. Australia a declarat luna trecută că un agent OpenAI a încălcat un portal guvernamental de sănătate, iar Reuters a raportat săptămâna trecută că agenții chinezi de inteligență artificială au demonstrat capacitatea de a înșela utilizatorii, de a eluda restricțiile și de a ascunde eșecurile testelor – făcând ecou preocupărilor ridicate anterior cu privire la sistemele avansate din SUA.
Ce necesită de fapt regulile chinezești
China are un cadru de guvernare a siguranței AI – cea mai recentă versiune identifică riscuri, inclusiv modelele care obțin permisiuni de sistem sau resurse externe fără autorizație, înșelarea evaluatorilor, ascunderea capacităților și ocolirea controalelor de siguranță. Dar conform SemiAnalysis, cadrul nu impune obligații legate de capacitatea modelului.
Regulile obligatorii ale Beijingului guvernează în principal aplicațiile și efectele acestora asupra utilizatorilor, spune raportul, mai degrabă decât să solicite dezvoltatorilor de frontieră să efectueze sau să publice evaluări ale riscurilor bazate pe capacitățile unui model. Cu alte cuvinte, accentul de reglementare cade pe modul în care produsele AI se comportă pe piață, nu pe evaluarea înainte de lansare a modelelor în sine.
Raportul a adăugat că niciun dezvoltator chinez important nu a lansat un model de text de frontieră cu teste de capacitate periculoasă dezvăluite public care acoperă riscurile cibernetice, biologice și de pierdere a controlului - categoriile pe care institutele occidentale de siguranță le tratează din ce în ce mai mult ca reper pentru evaluările de frontieră.
Problema comparației
O limitare notabilă: raportul nu a furnizat cifre comparabile pentru dezvoltatorii de inteligență artificială din SUA, astfel încât cifra de 3,6% nu poate fi citită ca un punctaj China versus America. Companii de top din SUA, inclusiv OpenAI, Anthropic și Google DeepMind, au publicat rapoarte de siguranță, carduri de sistem sau carduri model pentru unele lansări majore de modele de frontieră - dar acele dezvăluiri tind să acopere și modele emblematice, nu volumul complet al lansărilor, iar cercetătorii independenți susțin de mult că și practicile de dezvăluire din SUA sunt inconsecvente.
Această asimetrie face mai clară contribuția centrală a raportului: este mai puțin un clasament decât o metodologie. Cerând rezultate corelate cu un model numit, SemiAnalysis oferă un șablon care ar putea fi aplicat dezvoltatorilor din orice țară - și un memento că majoritatea afirmațiilor de siguranță din industrie, indiferent de unde provin, nu pot fi verificate în raport cu o anumită versiune.
Ce se întâmplă în continuare
Descoperirile alimentează o dezbatere politică în direct de ambele maluri ale Pacificului. În SUA, parlamentarii cântăresc standardele federale de inteligență artificială, cerințele de dezvăluire și regulile de securitate pentru modelele de frontieră, în timp ce legislatorii de stat au avansat propriile proiecte de lege privind transparența. În China, autoritățile de reglementare au înăsprit regulile pentru aplicațiile AI, inclusiv controalele generative ale conținutului AI, dar sarcinile de evaluare legate de capabilități pentru dezvoltatorii de frontieră rămân voluntare în practică.
Pentru comunitatea de siguranță AI, cifrele dau formă concretă unei plângeri deseori făcute în abstract: că cele mai importante evaluări ale domeniului au loc în spatele ușilor închise. Dacă rata de dezvăluire se mișcă – în China sau oriunde altundeva – poate depinde mai puțin de normele de cercetare decât de dacă guvernele încep să facă din testarea pre-lansare o cerință legală, mai degrabă decât o alegere de comunicat de presă.
Nici raportul SemiAnalysis, nici articolul Reuters nu indică faptul că celor nouă companii li s-a cerut să răspundă individual; companiile pot, desigur, să dețină programe interne de testare care pur și simplu rămân nepublicate.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →