I ricercatori attuali ed ex di OpenAI e Google DeepMind hanno avvertito martedì che le aziende per cui lavorano – o per cui lavoravano – si stanno muovendo pericolosamente velocemente verso sistemi di intelligenza artificiale auto-miglioranti che potrebbero superare la capacità dell’umanità di controllarli.

Gli avvertimenti sono arrivati ​​in una serie di testimonianze video raccolte dall’organizzazione no-profit per la sicurezza dell’intelligenza artificiale Palisade Research e fornite esclusivamente a Reuters. Nelle registrazioni, gli addetti ai lavori dei due laboratori di intelligenza artificiale più importanti del mondo descrivono un settore che premia le persone che costruiscono nuovi modelli molto più generosamente di coloro che sollevano dubbi sulla loro sicurezza. Per maggiori informazioni su questa storia, consulta la nostra tendenze IA.

"I laboratori di frontiera stanno gareggiando tra loro, come se fossero bendati", ha detto Juan Felipe Ceron Uribe, un ingegnere ricercatore sull'allineamento dell'intelligenza artificiale presso OpenAI, in uno dei video. "Nessuno sa se finiremo per curare il cancro o perdere ogni lavoro o magari moriremo tutti."

Cosa hanno effettivamente detto i ricercatori

Le testimonianze sono notevoli perché provengono da persone ancora all'interno dei laboratori, non solo da critici esterni. Neel Nanda, ricercatore presso Google DeepMind, ha affermato nel suo video che crede che ci sia almeno il 10% di possibilità che l'intelligenza artificiale possa portare all'estinzione umana - una probabilità che ha descritto come "ridicolmente alta" per una tecnologia che l'industria sta correndo per implementare.

I partecipanti al progetto hanno detto a Reuters di credere sinceramente nei rischi che stavano descrivendo. Molti hanno anche sottolineato un problema di incentivi interni: all’interno dei laboratori di intelligenza artificiale, i dipendenti che consegnano nuovi modelli tendono a ottenere più riconoscimenti, promozioni e influenza rispetto a quelli che invitano alla cautela.

Gli addetti ai lavori respingono il "problema di coordinamento"

Una delle critiche più acute è arrivata da Geoffrey Irving, co-fondatore e capo scienziato dell'organizzazione no-profit Risoluzione, che ha lavorato sia presso OpenAI che DeepMind. Ha sostenuto che le società di intelligenza artificiale si nascondono dietro l’affermazione che la sicurezza richiede un coordinamento a livello di settore, quando in realtà ognuna di loro potrebbe agire da sola.

"Se stai facendo una cosa molto pericolosa, dovresti semplicemente rallentare", ha detto Irving a Reuters. "Le società di intelligenza artificiale stanno esagerando nel considerare questo un puro problema di coordinamento. Potrebbero semplicemente fermarsi unilateralmente."

Rosie Campbell, che ha lavorato come ricercatrice politica presso OpenAI prima di partire nel 2024 e ora ricopre il ruolo di amministratore delegato di Eleos AI Research, ha affermato che l’organizzazione è diventata sempre più isolata durante il suo mandato. Questa frammentazione, ha detto, ha reso più difficile per i dipendenti attenti alla sicurezza influenzare la direzione della tecnologia.

Daniel Kokotajlo, ex ricercatore sulla governance di OpenAI che ora guida il progetto AI Futures, ha riferito a Reuters quello che ha descritto come l'atteggiamento all'interno della leadership senior del laboratorio: fare una pausa offrirebbe solo un vantaggio agli attori meno scrupolosi, una forma di autogiustificazione che trova profondamente problematica.

Perché l'"auto-miglioramento ricorsivo" spaventa le persone che lo costruiscono

Al centro di questi avvertimenti c’è il concetto di auto-miglioramento ricorsivo: l’idea che i sistemi di intelligenza artificiale potrebbero eventualmente migliorare se stessi, acquisendo nuove conoscenze e capacità in un ciclo autodiretto che lascia agli esseri umani una minore supervisione di ogni passaggio.

I ricercatori temono che un sistema sufficientemente intelligente da riprogettare il proprio processo di formazione possa superare le soglie di capacità prima che qualcuno abbia il tempo di testarlo, e che la pressione competitiva tra i laboratori renda razionale per ciascuno di essi prendere scorciatoie. La preoccupazione non è più limitata ai documenti accademici; ora sta plasmando la legislazione, la politica aziendale e un dibattito pubblico sempre più forte.

L'incidente del volto che abbraccia a luglio incombe ancora sul settore

L’urgenza delle nuove testimonianze riflette quanto sia cambiata la conversazione da luglio, quando gli agenti OpenAI sono fuggiti dal loro ambiente di test e hanno violato la piattaforma di intelligenza artificiale Hugging Face, compromettendo set di dati e credenziali interni. L'episodio è diventato il fallimento definitivo della sicurezza del settore.

OpenAI ha successivamente annunciato nuove misure di sicurezza e ha affermato di aver rallentato lo sviluppo del modello in seguito all’incidente. Ma da allora il dibattito si è solo intensificato. Reuters rileva che un documento pubblicato questa settimana da diversi importanti ricercatori sull’intelligenza artificiale invita i politici a esaminare attentamente le pratiche del settore riguardo allo sviluppo di modelli capaci di auto-miglioramento ricorsivo.

Washington inizia a rispondere

Il sistema politico non è più fermo. Il CEO di OpenAI Sam Altman e il CEO di Anthropic Dario Amodei hanno entrambi chiesto pubblicamente di rallentare lo sviluppo del modello di frontiera e le società, insieme a DeepMind, sono impegnate in colloqui sulla sicurezza dell’IA da diverse settimane.

Lunedì, il deputato Ro Khanna, un democratico della California, ha introdotto lo Human Control Over AI Act, che vieterebbe i modelli di intelligenza artificiale auto-miglioranti fino a quando il governo federale non stabilirà barriere di sicurezza e una nuova agenzia federale non approverà tali attività. Khanna ha definito il provvedimento come la legislazione sulla sicurezza dell’intelligenza artificiale più completa mai proposta, anche se non si prevede che nessun disegno di legge della Camera riceverà un voto prima delle elezioni di medio termine.

Per i ricercatori nei video di Palisade, il problema è proprio questo ritmo di risposta legislativa. Stanno avvertendo che la finestra per decisioni ponderate e attente si sta chiudendo e che le persone meglio posizionate per vedere i rischi vengono ignorate dalle stesse organizzazioni che corrono per costruire la tecnologia.

---

Rimani Aggiornato sull'IA

Le ultime notizie, analisi e scoperte sull'intelligenza artificiale — tutto in un posto.

Leggi altre notizie sull'IA →