Google DeepMind spustil nový institut věnovaný rozšíření konverzace o umělé obecné inteligenci – a jeho inaugurační eseje zahrnují konkrétní návrh Demise Hassabise na orgán vedený USA, který by před nasazením vyhodnotil hraniční modely umělé inteligence.
Institut DeepMind, který ve středu zahájili výzkumníci společností Google a Google DeepMind, uvádí spoluzakladatele DeepMind Shane Legga jako svého hlavního redaktora spolu s výkonným ředitelem Googlu Jamesem Manyikou a předsedou Google DeepMind Demisem Hassabisem jako řediteli, podle TechCrunch. For more context on this story, see our ongoing AI industry coverage.
Prostor k nesouhlasu
Deklarovaným účelem institutu je odhalit skutečný nesouhlas – a to i uvnitř samotné společnosti Google. "Nebudou vždy souhlasit a pravděpodobně změní názor, protože na rychle se pohybující hranici se objeví více dat a informací," stojí v oznámení.
Jeho první sbírka obsahuje čtyři eseje týkající se ekonomických politik pro řízení potenciálního narušení AGI, zachování lidsky čitelného modelového uvažování, principů lidského rozkvětu a rámce pro hodnocení hraničních modelů umělé inteligence.
Institucionalizace otevřeného nesouhlasu je neobvyklým krokem pro podnikovou laboratoř AI, kde je zasílání veřejných zpráv obvykle přísně kontrolováno. Institut svým záměrem poskytuje výzkumníkům Google prostor pro argumentaci pozic, které mohou být v rozporu s obchodními zájmy společnosti – nebo se zájmy ostatních.
Esej o transparentnosti: Sledujte „neprůhlednou sériovou hloubku“
Jedna ze čtyř esejů od bezpečnostních výzkumníků DeepMind Rohin Shah a Anca Dragan tvrdí, že zmenšující se okno transparentnosti AI – schopnost vidět a kontrolovat uvažování modelu krok za krokem – není nevyhnutelné, i když nové architektury znesnadňují sledování nejvýkonnějších modelů.
Autoři říkají, že vývojáři a regulátoři by měli čelit bezpečnostním kompromisům přímo. Konkrétně by to mohlo znamenat omezení toho, čemu říkají „neprůhledná sériová hloubka“ – množství sekvenčních výpočtů, které model může provést, aniž by vytvořil čitelnou stopu uvažování – nebo vyžadovat, aby vývojáři prokázali, že méně transparentní systémy zůstávají stejně monitorovatelné jako ty interpretovatelné.
Návrh je pozoruhodný, protože ztrátu interpretovatelnosti považuje spíše za návrh a politickou volbu než za nevyhnutelný důsledek rozsahu, čímž otevírá dveře požadavkům, které by bylo možné zapsat do regulace.
Hassabisův návrh: orgán pro hraniční standardy USA
Nejdůležitější esej může být Hassabisova. Navrhuje orgán pro hraniční standardy AI pod vedením USA, který má za úkol vyhodnotit nejpokročilejší modely AI. V rámci tohoto rámce by vývojáři zpočátku dobrovolně předkládali modely ke kontrole až 30 dní před vydáním. Jakmile se systém hodnocení osvědčí, absolvování jeho testů by se mohlo stát požadavkem pro nasazení hraničních modelů ve Spojených státech.
Orgán by začal navrhováním hodnocení po konzultaci se společnostmi s umělou inteligencí, ale nakonec by vyvinul nezávislá, nezveřejněná hodnocení – čemu esej říká „předložené“ testy – aby zabránila laboratořím přizpůsobit své modely známým benchmarkům, což je dobře zdokumentovaný způsob selhání veřejných hodnotících režimů.
Hassabis také ponechal dveře otevřené eskalaci: rámec by mohl být „zrychlen, pokud to vyžaduje vážnost situace“, případně včetně koordinovaného zpomalení mezi hraničními vývojáři AI.
Proč na dalších dvou esejích záleží
Zbývající dvě eseje – o ekonomických politikách pro zvládání narušení AGI ao principech lidského rozkvětu – doplňují sbírku, která pojednává o AGI spíše jako o celospolečenském problému než jako o čistě technickém. Ekonomické vysídlení je již dlouho nejhmatatelnějším veřejným zájmem týkajícím se pokročilé umělé inteligence a pokud jej zarámujeme spolu s politikou hodnocení a interpretovatelností, institut chce, aby tvůrci politik viděli jednotlivé části jako jednu agendu spíše než samostatné debaty.
Tato šíře je také signálem o pozici Google. Společnost soutěží o podnikové zákazníky a státní zakázky a zároveň tvrdí, že hraniční systémy potřebují vnější kontrolu. Základním předpokladem institutu je spíše zveřejňování napětí než jeho vyhlazování.
Od starostí ke konkrétním návrhům
Eseje přicházejí v době, kdy se debata o bezpečnosti v tomto odvětví posouvá od širokých prohlášení o obavách ke konkrétním mechanismům: požadavky na zveřejnění, vnější kontrola a – pokud bezpečnostní opatření zaostávají – koordinovaná zpomalení. Tento posun se tento týden zrychlil, když lídři v oboru podle TechCrunch podpořili prvky výzvy generálního ředitele společnosti Anthropic Daria Amodeie k „urychlení“ vývoje hraniční umělé inteligence.
Na načasování záleží. Vlády na obou stranách Atlantiku zvažují, jak dohlížet na systémy, jejichž schopnosti se rozvíjejí rychleji než vyhodnocovací infrastruktura. Návrh, který pochází z přední laboratoře umělé inteligence – a který zahrnuje důkladnou kontrolu před vydáním – poskytuje tvůrcům politik šablonu, kterou samotné odvětví nominálně podpořilo, což bylo historicky předpokladem pro smysluplnou regulaci umělé inteligence.
Na co se dívat
Prvním testem bude redakční nezávislost institutu na Googlu. Pokud budou eseje i nadále zahrnovat pozice, které jsou v rozporu s obchodním plánem společnosti Google – jak to pravděpodobně dělá esej o transparentnosti – místo by se mohlo stát vážným přispěvatelem do debaty o politice AGI. Pokud se posune směrem k firemnímu zasílání zpráv, bude to další PR kanál na přeplněném poli.
Ať tak či onak, podstata je nyní na stole: požadavky na hodnocení před vydáním, odložené testy a dokonce i koordinované zpomalení veřejně argumentuje jedna z nejmocnějších postav v AI. Otázkou již není, zda by měly být hraniční modely hodnoceny nezávisle, ale kdo hodnocení provádí – a v jakém časovém plánu.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →