Google DeepMind har gjort Interactions API till standardgränssnittet för sina Gemini-modeller och -agenter, och slutfört ett skifte bort från det äldre "generateContent"-gränssnittet som har förankrat Gemini-utvecklingen sedan modellerna först levererades. Flytten, som tillkännagavs på Googles utvecklarblogg den 26 juni, lyfter ett API som har varit i beta sedan december 2025 till det primära sättet som utvecklare förväntas bygga på Gemini.

Det äldre "generateContent"-gränssnittet fungerar fortfarande, betonade Google, så befintliga applikationer kommer inte att gå sönder över en natt. Men företaget drar nu en fast linje: nya agentfunktioner kommer bara att skickas via Interactions API framöver. For more context on this story, see our ongoing artificial intelligence updates.

> "Interaktioner sätter scenen för den nya eran av agenter."
>
> — Logan Kilpatrick, ledare för Googles utvecklarrelationer

Google har publicerat en migreringsguide för att hjälpa utvecklare att flytta från det tidigare gränssnittet, och det nya API:et är nu standard i Google AI Studio och i all officiell Gemini-dokumentation.

Vad Interactions API ändrar

Den viktigaste förändringen är strukturell. Det tidigare gränssnittet organiserade konversationer kring roller - etiketter som "användare" och "modell" - som speglar det välbekanta chattformat som de flesta stora språkmodeller API:er antog. Interactions API ersätter den rollbaserade strukturen med skrivna steg, där varje åtgärd, från en användares inmatning till ett funktionsanrop till ett modellsvar, är ett eget uttryckligen definierat steg.

Resultatet, enligt Google, är ett schema som är bättre lämpat för komplexa agentarbetsflöden snarare än enkel fram och tillbaka chatt. Agenter behöver rutinmässigt kedja ihop verktygsanrop, köra i bakgrunden och förgrena sig baserat på mellanresultat – mönster som den gamla rollbaserade konversationsmodellen hanterade obekvämt.

Inbyggda Agent Primitives

Sedan det gick in i betaversionen i slutet av 2025 har Interactions API samlat på sig en uppsättning funktioner som Google positionerar som förstklassiga agentbyggstenar:

  • Managed Agents som körs i sin egen Linux-sandlåda, vilket ger utvecklare en isolerad miljö för exekvering av agentgenererad kod och kommandon.
  • Bakgrundsexekvering för långvariga uppgifter, vilket gör att agenter kan fortsätta arbeta asynkront istället för att blockera på en enda begäran.
  • Verktygskedja med Google Sök och Google Maps inbyggda, så att agenter kan hämta information i realtid och platsdata utan att utvecklare kopplar in dessa integrationer manuellt.
  • Mediegenerering som spänner över bilder, musik och tal, låter ett gränssnitt för en agent producera multimodal utdata.

Google har också förenklat delar av schemat sedan betaversionen, och tagit bort friktion som tidiga användare hade flaggat.

Flex och prioriterade lägen

Utvecklare som bygger på Interactions API kan välja mellan två körningslägen. Flexläget sänker kostnaderna med ungefär 50 procent och byter ut viss latens mot billigare slutledningar – användbart för högvolymsarbete eller bakgrundsarbete. Prioritetsläge optimerar istället för hastighet och dirigerar förfrågningar för snabbast svar.

Kostnadshävstången är viktig för Google i konkurrens. Enterprise AI-utgifter har blivit ett centralt bekymmer i branschen, med företag som alltmer granskar symboliska kostnader som modellanvändningsskalor. Att erbjuda ett 50-procentigt kostnadsreduktionsläge ger Gemini-utvecklare ett konkret sätt att hålla tillbaka räkningar utan att lämna plattformen.

Varför skiftet är viktigt

Övergången speglar en bredare branschpivot från chatt-gränssnitt till agent-gränssnitt. Där tidiga LLM-produkter inramades som konversationsassistenter, är den nuvarande vågen av utvecklarverktyg byggd kring autonoma och semi-autonoma agenter som utför flerstegsuppgifter över verktyg och tjänster.

Genom att göra Interactions API till standard – och reservera nya agentfunktioner exklusivt för det – knuffar Google hela sin utvecklarbas till infrastruktur designad för den agentens framtid. Utvecklare som stannar på "generateContent" kommer att behålla kompatibiliteten men kommer successivt att missa nya funktioner.

Förändringen kommer när konkurrensen om agentskiktet hårdnar. Anthropic har lutat sig åt agentinfrastruktur med sina Claude Code och Claude Tag-produkter, OpenAI fortsätter att utöka sina agent- och datoranvändningsmöjligheter, och ramverk med öppen källkod förökar sig. Googles satsning är att ägandet av utvecklargränssnittet – inte bara den underliggande modellen – kommer att vara avgörande när agentapplikationer går in i produktionen.

Google har inte meddelat något slutdatum för "generateContent"-gränssnittet, men den tydliga riktningen är att Interactions API nu är vägen framåt för alla som bygger på Gemini.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →