Google DeepMind har lanserat ett nytt institut dedikerat till att bredda samtalet kring artificiell allmän intelligens – och dess inledande essäer inkluderar ett konkret förslag från Demis Hassabis till ett USA-ledd organ som skulle utvärdera frontier AI-modeller före implementering.

DeepMind Institute, som lanserades i onsdags av forskare från Google och Google DeepMind, listar DeepMinds medgrundare Shane Legg som sin chefredaktör, tillsammans med Googles verkställande direktör James Manyika och Google DeepMind-ordföranden Demis Hassabis som direktörer, enligt TechCrunch. For more context on this story, see our ongoing latest AI developments.

Utrymme att inte hålla med

Institutets uttalade syfte är att få fram äkta oenighet – inklusive inom Google själv. "De kommer inte alltid att hålla med, och de kommer sannolikt att ändra uppfattning, eftersom mer data och information kommer fram vid den snabbt rörliga gränsen", lyder meddelandet.

Dess första samling består av fyra essäer som täcker ekonomisk policy för att hantera potentiella AGI-avbrott, bevara mänskligt läsbara modellresonemang, principer för mänsklig blomstring och ett ramverk för att utvärdera frontier AI-modeller.

Att institutionalisera öppen oenighet är ett ovanligt drag för ett företags AI-labb, där offentliga meddelanden tenderar att vara hårt kontrollerade. Genom designen ger institutet Googles forskare en plats att argumentera för ståndpunkter som kan komma i konflikt med företagets kommersiella intressen – eller med varandras.

The Transparency Essay: Titta på "Opaque Serial Depth"

En av de fyra uppsatserna, av DeepMind-säkerhetsforskarna Rohin Shah och Anca Dragan, hävdar att AI:s krympande fönster av transparens – förmågan att se och kontrollera en modells steg-för-steg-resonemang – inte är oundviklig, även om nya arkitekturer gör de mest kraftfulla modellerna svårare att övervaka.

Författarna säger att utvecklare och tillsynsmyndigheter bör konfrontera säkerhetsavvägningarna direkt. Konkret kan det innebära att begränsa vad de kallar "ogenomskinligt seriellt djup" - mängden sekventiell beräkning som en modell kan utföra utan att producera ett läsbart resonemangsspår - eller kräva att utvecklare visar att mindre transparenta system förblir lika övervakbara som tolkbara.

Förslaget är anmärkningsvärt eftersom det behandlar förlust av tolkningsbarhet som ett design- och policyval snarare än en oundviklig konsekvens av skalan, vilket öppnar dörren för krav som skulle kunna skrivas in i förordningen.

Hassabis förslag: ett amerikanskt gränsstandardorgan

Den mest betydelsefulla uppsatsen kan vara Hassabis. Han föreslår en USA-ledd gräns för AI-standardiseringsorgan med uppgift att utvärdera de mest avancerade AI-modellerna. Enligt ramverket skulle utvecklare initialt lämna in modeller frivilligt för granskning upp till 30 dagar före release. När väl utvärderingssystemet har visat sig effektivt, kan godkända tester bli ett krav för att implementera frontier-modeller i USA.

Organet skulle börja med att utforma bedömningar i samråd med AI-företag, men skulle så småningom utveckla oberoende, hemliga utvärderingar - vad uppsatsen kallar "uthållna" tester - för att förhindra laboratorier från att skräddarsy sina modeller till kända riktmärken, ett väldokumenterat misslyckande för offentliga utvärderingsregimer.

Hassabis lämnade också dörren öppen för eskalering: ramverket kan "höjas om situationens allvar kräver det", potentiellt inklusive en koordinerad avmattning bland gränsöverskridande AI-utvecklare.

Varför de andra två uppsatserna är viktiga

De återstående två uppsatserna – om ekonomisk politik för att hantera AGI-avbrott och om principer för mänsklig blomstring – avslutar en samling som behandlar AGI som ett samhällsomfattande problem snarare än ett rent tekniskt. Ekonomisk förskjutning har länge varit den mest påtagliga offentliga angelägenheten kring avancerad AI, och att rama in det tillsammans med utvärderingspolicy och tolkningsbarhet tyder på att institutet vill att beslutsfattare ska se bitarna som en agenda snarare än separata debatter.

Den bredden är också en signal om Googles positionering. Företaget konkurrerar om företagskunder och statliga kontrakt samtidigt som det hävdar att gränssystem behöver granskas utifrån. Att publicera spänningen, snarare än att jämna ut den, är institutets kärnpremiss.

Från oro till konkreta förslag

Uppsatserna kommer när branschens säkerhetsdebatt övergår från breda uttalanden om oro mot specifika mekanismer: krav på avslöjande, granskning utifrån och - om skyddsåtgärder faller efter - samordnade nedgångar. Den förändringen accelererade den här veckan när branschledare stödde delar av Antropisk VD Dario Amodeis uppmaning att "tempa" frontier AI-utveckling, enligt TechCrunch.

Tidpunkten spelar roll. Regeringar på båda sidor om Atlanten överväger hur man ska övervaka system vars kapacitet utvecklas snabbare än utvärderingsinfrastruktur. Ett förslag som har sitt ursprung i ett ledande AI-labb – och som inkluderar pre-release granskning med tänder – ger beslutsfattare en mall som industrin själv nominellt har godkänt, vilket historiskt sett har varit en förutsättning för meningsfull AI-reglering.

Vad du ska titta på

Institutets redaktionella oberoende från Google blir det första testet. Om uppsatserna fortsätter att inkludera ståndpunkter som strider mot Googles kommersiella färdplan – som öppenhetsuppsatsen utan tvekan gör – kan platsen bli en seriös bidragsgivare till AGI-politisk debatt. Om det går mot företagsmeddelanden blir det ytterligare en PR-kanal i ett trångt fält.

Hur som helst, ämnet ligger på bordet nu: krav på utvärdering av pre-release, uthållna tester och till och med en samordnad avmattning argumenteras för offentligt av en av de mäktigaste figurerna inom AI. Frågan är inte längre om frontiermodeller ska utvärderas självständigt, utan vem som gör utvärderingen – och enligt vilken tidtabell.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →