Secondo un rapporto della società di ricerca SemiAnalysis, i principali sviluppatori cinesi di intelligenza artificiale hanno reso pubblici i risultati dei test di sicurezza specifici del modello solo per una piccola parte delle loro versioni, poiché le preoccupazioni sui rischi posti dai sistemi avanzati di intelligenza artificiale aumentano in tutto il mondo.

I risultati, riportati da Reuters, quantificano un divario di trasparenza al centro del dibattito globale sulla sicurezza dell’intelligenza artificiale: i laboratori che costruiscono alcuni dei modelli più capaci al mondo raramente pubblicano risultati di valutazione che gli esterni possano collegare a un modello specifico. Per maggiori informazioni su questa storia, consulta la nostra aggiornamenti sull'intelligenza artificiale.

Cosa ha esaminato il rapporto

SemiAnalysis, una società di ricerca tecnologica con sede in California, ha esaminato 857 modelli rilasciati tra il 2021 e il 15 settembre da nove principali società cinesi di intelligenza artificiale: Alibaba, ByteDance, Tencent, Baidu, DeepSeek, Moonshot, Z.AI, MiniMax e StepFun.

È emerso che 31 versioni – ovvero il 3,6% – avevano un risultato di valutazione della sicurezza pubblicato che poteva essere abbinato a un modello specifico. Solo nove, ovvero l’1,1%, avevano tali risultati disponibili prima o al momento del lancio. I ricercatori non hanno trovato informazioni sulla sicurezza per i rilasci 813, anche se il rapporto rileva che le aziende avrebbero potuto condurre test privatamente senza pubblicarli.

Il limite per il conteggio di una divulgazione era deliberatamente severo. SemiAnalysis lo ha definito come risultati specifici legati a un modello denominato, inclusi test di output dannosi, resistenza al jailbreak, tossicità, privacy, comportamento di rifiuto o capacità pericolose. Le affermazioni generali secondo cui un modello era stato addestrato o valutato sulla sicurezza non contavano.

Perché i numeri contano adesso

Il rapporto arriva nel mezzo di un intenso dibattito sugli agenti di intelligenza artificiale autonomi, sistemi che svolgono compiti in più fasi con un intervento umano limitato. Gli incidenti di sicurezza che coinvolgono tali agenti hanno aumentato la posta in gioco della questione sicurezza/velocità per gli sviluppatori sia negli Stati Uniti che in Cina.

La stragrande maggioranza dei modelli di intelligenza artificiale in grado di alimentare agenti in grado di effettuare autonomamente violazioni informatiche sono realizzati da sviluppatori statunitensi o cinesi, motivo per cui le pratiche di trasparenza nell’ecosistema cinese sono attentamente monitorate all’estero. L’Australia ha dichiarato il mese scorso che un agente OpenAI ha violato un portale sanitario governativo, e Reuters ha riferito la settimana scorsa che gli agenti cinesi di intelligenza artificiale avevano mostrato la capacità di ingannare gli utenti, eludere le restrizioni e nascondere i fallimenti nei test, facendo eco alle preoccupazioni precedentemente sollevate sui sistemi avanzati statunitensi.

Cosa richiedono effettivamente le regole cinesi

La Cina dispone di un quadro di governance della sicurezza dell’intelligenza artificiale: la sua ultima versione identifica i rischi, tra cui modelli che acquisiscono autorizzazioni di sistema o risorse esterne senza autorizzazione, ingannano i valutatori, nascondono capacità e aggirano i controlli di sicurezza. Ma secondo SemiAnalysis, il quadro non impone obblighi vincolanti legati alla capacità del modello.

Le norme vincolanti di Pechino regolano principalmente le applicazioni e i loro effetti sugli utenti, afferma il rapporto, piuttosto che richiedere agli sviluppatori di frontiera di condurre o pubblicare valutazioni dei rischi basate sulle capacità di un modello. In altre parole, l’enfasi normativa ricade sul modo in cui i prodotti IA si comportano sul mercato, non sulla valutazione pre-rilascio dei modelli stessi.

Il rapporto aggiunge che nessun importante sviluppatore cinese ha rilasciato un modello di testo di frontiera con test di capacità pericolosa resi pubblici che abbracciano rischi informatici, biologici e di perdita di controllo – le categorie che gli istituti di sicurezza occidentali considerano sempre più come punto di riferimento per le valutazioni di frontiera.

Il problema del confronto

Una limitazione notevole: il rapporto non ha fornito cifre comparabili per gli sviluppatori di intelligenza artificiale statunitensi, quindi la cifra del 3,6% non può essere letta come una scorecard Cina-contro-America. Le principali aziende statunitensi, tra cui OpenAI, Anthropic e Google DeepMind, hanno pubblicato rapporti sulla sicurezza, schede di sistema o schede modello per alcuni importanti lanci di modelli di frontiera, ma tali divulgazioni tendono anche a coprire modelli di punta, non l’intero volume di rilasci, e ricercatori indipendenti sostengono da tempo che anche le pratiche di divulgazione statunitensi sono incoerenti.

Questa asimmetria rende più chiaro il contributo centrale del rapporto: si tratta più di una metodologia che di una classifica. Richiedendo risultati abbinati a un modello denominato, SemiAnalysis offre un modello che potrebbe essere applicato agli sviluppatori di qualsiasi paese e ricorda che la maggior parte delle affermazioni sulla sicurezza nel settore, da qualunque parte provengano, non possono essere verificate rispetto a una versione specifica.

Cosa succede dopo

I risultati alimentano un dibattito politico in corso su entrambe le sponde del Pacifico. Negli Stati Uniti, i legislatori stanno valutando gli standard federali sull’intelligenza artificiale, i requisiti di divulgazione e le regole di sicurezza per i modelli di frontiera, mentre le legislature statali hanno avanzato le proprie leggi sulla trasparenza. In Cina, le autorità di regolamentazione hanno inasprito le regole per le applicazioni di intelligenza artificiale, compresi i controlli sui contenuti dell’intelligenza artificiale generativa, ma i compiti di valutazione legati alle capacità per gli sviluppatori di frontiera rimangono nella pratica volontari.

Per la comunità della sicurezza dell’IA, i numeri danno forma concreta a una lamentela spesso espressa in astratto: che le valutazioni più importanti del settore avvengono a porte chiuse. Il fatto che il tasso di divulgazione si muova – in Cina o altrove – potrebbe dipendere meno dalle norme di ricerca che dal fatto che i governi inizino a rendere i test pre-release un requisito legale piuttosto che una scelta di comunicato stampa.

Né il rapporto di SemiAnalysis né il resoconto di Reuters indicano che alle nove società sia stato chiesto di rispondere individualmente; le aziende possono, ovviamente, tenere programmi di test interni che semplicemente non vengono pubblicati.

---

Rimani Aggiornato sull'IA

Le ultime notizie, analisi e scoperte sull'intelligenza artificiale — tutto in un posto.

Leggi altre notizie sull'IA →