Google DeepMind a lansat un nou institut dedicat extinderii conversației despre inteligența generală artificială – iar eseurile sale inaugurale includ o propunere concretă a lui Demis Hassabis pentru un organism condus de SUA care ar evalua modelele de IA de frontieră înainte de implementare.
Institutul DeepMind, lansat miercuri de Google și cercetătorii Google DeepMind, îl listează pe co-fondatorul DeepMind, Shane Legg, ca redactor director, alături de directorul executiv al Google, James Manyika, și președintele Google DeepMind, Demis Hassabis, ca directori, potrivit TechCrunch. For more context on this story, see our ongoing AI industry coverage.
Cameră de dezacord
Scopul declarat al institutului este de a scoate la iveală un dezacord real, inclusiv în cadrul Google însuși. „Nu vor fi întotdeauna de acord și probabil că se vor răzgândi, pe măsură ce mai multe date și informații ies la lumină la frontiera care se mișcă rapid”, se arată în anunț.
Prima sa colecție cuprinde patru eseuri care acoperă politicile economice pentru gestionarea potențialelor perturbări AGI, păstrarea raționamentului model care poate fi citit de om, principiile pentru înflorirea umană și un cadru pentru evaluarea modelelor AI de frontieră.
Instituționalizarea dezacordului deschis este o mișcare neobișnuită pentru un laborator corporativ de inteligență artificială, unde mesajele publice tind să fie strict controlate. Prin proiectare, institutul oferă cercetătorilor Google un loc pentru a argumenta poziții care ar putea intra în conflict cu interesele comerciale ale companiei - sau cu ale celuilalt.
Eseul de transparență: urmăriți „Adancimea serialului opac”
Unul dintre cele patru eseuri, al cercetătorilor în domeniul siguranței DeepMind, Rohin Shah și Anca Drăgan, susține că fereastra de transparență în scădere a AI - capacitatea de a vedea și de a verifica raționamentul pas cu pas al unui model - nu este inevitabil, chiar dacă noile arhitecturi fac cele mai puternice modele mai greu de monitorizat.
Autorii spun că dezvoltatorii și autoritățile de reglementare ar trebui să se confrunte direct cu compromisurile legate de siguranță. Concret, asta ar putea însemna limitarea a ceea ce ei numesc „adâncime serial opac” - cantitatea de calcul secvenţial pe care un model o poate efectua fără a produce o urmă de raţionament care poate fi citită - sau solicitarea dezvoltatorilor să demonstreze că sistemele mai puţin transparente rămân la fel de monitorizate ca şi cele interpretabile.
Propunerea este notabilă pentru că tratează pierderea de interpretabilitate ca o alegere de proiectare și politică, mai degrabă decât o consecință inevitabilă a amplorii, deschizând ușa către cerințe care ar putea fi incluse în reglementări.
Propunerea lui Hassabis: un organism de standarde de frontieră din SUA
Cel mai important eseu poate fi al lui Hassabis. El propune un organism de standarde AI de frontieră condus de SUA, însărcinat cu evaluarea celor mai avansate modele AI. În cadrul acestui cadru, dezvoltatorii ar trimite inițial modele în mod voluntar pentru revizuire cu până la 30 de zile înainte de lansare. Odată ce sistemul de evaluare s-a dovedit eficient, trecerea testelor sale ar putea deveni o cerință pentru implementarea modelelor de frontieră în Statele Unite.
Organismul ar începe prin a proiecta evaluări în consultare cu companiile de inteligență artificială, dar va dezvolta în cele din urmă evaluări independente, nedezvăluite – ceea ce eseul numește teste „întârziate” – pentru a împiedica laboratoarele să-și adapteze modelele la criteriile de referință cunoscute, un mod de eșec bine documentat al regimurilor publice de evaluare.
Hassabis a lăsat, de asemenea, ușa deschisă escaladării: cadrul ar putea fi „întărit dacă gravitatea situației o cere”, incluzând potențial o încetinire coordonată în rândul dezvoltatorilor de IA de frontieră.
De ce contează celelalte două eseuri
Celelalte două eseuri – despre politicile economice pentru gestionarea perturbării AGI și despre principiile pentru înflorirea umană – completează o colecție care tratează AGI ca o problemă la nivel de societate, mai degrabă decât una pur tehnică. Deplasarea economică a fost mult timp cea mai tangibilă preocupare publică în jurul IA avansată, iar încadrarea acesteia alături de politica de evaluare și interpretabilitate sugerează că institutul dorește ca factorii de decizie să vadă piesele ca o singură agendă, mai degrabă decât dezbateri separate.
Această amploare este, de asemenea, un semnal despre poziționarea Google. Compania concurează pentru clienți întreprinderi și contracte guvernamentale, susținând în același timp că sistemele de frontieră au nevoie de control extern. Publicarea tensiunii, mai degrabă decât netezirea acesteia, este premisa de bază a institutului.
De la preocupare la propuneri concrete
Eseurile apar pe măsură ce dezbaterea industriei privind siguranța trece de la declarații ample de îngrijorare la mecanisme specifice: cerințe de dezvăluire, control extern și – dacă măsurile de siguranță rămân în urmă – încetiniri coordonate. Această schimbare s-a accelerat săptămâna aceasta, deoarece liderii din industrie au susținut elemente din apelul CEO-ului Anthropic, Dario Amodei, de a „ritma” dezvoltarea AI de frontieră, conform TechCrunch.
Momentul contează. Guvernele de pe ambele maluri ale Atlanticului analizează cum să supravegheze sistemele ale căror capacități avansează mai repede decât infrastructura de evaluare. O propunere care provine dintr-un laborator de inteligență artificială de top – și care include o revizuire pre-lansare cu dinți – oferă factorilor de decizie un șablon pe care industria însăși l-a aprobat nominal, care a fost din istorie o condiție prealabilă pentru o reglementare semnificativă a IA.
Ce să urmărești
Independența editorială a institutului față de Google va fi primul test. Dacă eseurile continuă să includă poziții care contravin planului comercial Google – așa cum se poate spune că eseul despre transparență – locul ar putea deveni un contributor serios la dezbaterea privind politica AGI. Dacă se îndreaptă către mesajele corporative, va fi încă un canal de PR într-un câmp aglomerat.
Oricum, substanța este acum pe masă: cerințele de evaluare înainte de lansare, testele susținute și chiar o încetinire coordonată sunt susținute public de una dintre cele mai puternice figuri din AI. Întrebarea nu mai este dacă modelele de frontieră ar trebui evaluate în mod independent, ci cine face evaluarea – și în ce orar.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →