Google introducerade en trio av nya Gemini-modeller den 21 juli 2026, vilket fördubblade effektiviteten och kostnadseffektiviteten som utvecklare behöver för att bygga produktions-AI-agenter i stor skala. Företaget presenterade Gemini 3.6 Flash, Gemini 3.5 Flash-Lite och Gemini 3.5 Flash Cyber, som var och en riktar sig mot ett annat segment av det allt mer konkurrenskraftiga AI-modelllandskapet. För en omfattande täckning av den senaste utvecklingen inom brytande AI-nyheter, markerar dessa utgåvor Googles mest aggressiva satsning hittills för att vinna den kostnadskänsliga utvecklarmarknaden.
Tillkännagivandet kommer vid ett avgörande ögonblick för sökjätten. Medan konkurrenter som OpenAI och Anthropic har fångat uppmärksamheten med sina flaggskeppsmodeller, har Googles Flash-serie skapat en nisch för utvecklare som behöver driva AI-agenter ekonomiskt och tillförlitligt. De nya modellerna representerar ett betydande steg uppåt både vad gäller kvalitet och effektivitet i agenturets arbetsflöden.
Gemini 3.6 Flash: The New Workhorse Model
Gemini 3.6 Flash är positionerad som Googles arbetshästmodell och bygger direkt på feedback från utvecklare som använder den tidigare 3.5 Flash. Enligt Googles tillkännagivande, författad av Senior Director of Product Management Tulsee Doshi, levererar modellen förbättrad kodning, kunskapsarbete och multimodal prestanda samtidigt som den på ett meningsfullt sätt minskar tokenförbrukningen.
På det artificiella analysindexet förbrukar Gemini 3.6 Flash 17 % färre output-tokens än sin föregångare. I vissa benchmarks, som DeepSWE av Datacurve, når minskningen upp till 65 %. Modellen kräver också färre resonemangssteg och verktygsanrop för att åstadkomma flerstegsarbetsflöden.
Prissättningen har satts till 1,50 USD per miljon inmatade tokens och 7,50 USD per miljon output-tokens, vilket underskrider den tidigare generationen. Detta gör agenter mer kostnadseffektiva att bygga och driva i stor skala, en kritisk faktor för företag som använder AI för tusentals samtidiga uppgifter.
Benchmark-förbättringar
Google rapporterade flera anmärkningsvärda prestandavinster jämfört med 3,5 Flash:
- DeepSWE: 49 % mot 37 %, vilket återspeglar högre precision i kodredigering med färre oönskade redigeringar och minskade exekveringsslingor
- MLE Bench: 63,9 % mot 49,7 %, ett betydande steg i forskningskapaciteten för maskininlärning
- OSWorld-Verified: 83,0 % mot 78,4 %, visar förbättrade datoranvändningsmöjligheter
- GDPval-AA v2: 1421 mot 1349, vilket återspeglar vinster i kunskapsarbetsuppgifter
Datoranvändning är nu tillgänglig som ett inbyggt verktyg på klientsidan via Gemini API och Gemini Enterprise, vilket eliminerar behovet av orkestreringslager från tredje part.
Gemini 3.5 Flash-Lite: Byggd för hastighet och skala
Vid sidan av Flash-uppgraderingen släppte Google Gemini 3.5 Flash-Lite, designad för uppgifter med låg latens och hög genomströmning av arbetsbelastningar som agentsökning och dokumentbearbetning. Det är den snabbaste modellen i 3.5-serien, som körs med 350 utsignaler per sekund mätt med artificiell analys.
Prissatt aggressivt till $0,30 per miljon indatatokens och $2,50 per miljon output-tokens, erbjuder Flash-Lite ett övertygande pris-prestandaförhållande för utvecklare som kör produktionstrafik i stor skala. Google noterade att i många agent- och kodningsutvärderingar överträffar modellen till och med den större Gemini 3 Flash, inklusive på SWE-Bench Pro (54,2 % mot 49,6 %) och OSWorld-Verified (74,0 % mot 65,1 %).
Modellen stöder konfigurerbara tankenivåer, vilket gör det möjligt för utvecklare att prioritera körning med låg latens för uppgifter med stora volymer eller engagera högre tankenivåer för komplexa subagentarbetsbelastningar i flera steg.
Gemini 3.5 Flash Cyber: AI för kodsäkerhet
Den tredje versionen, Gemini 3.5 Flash Cyber, är en specialiserad modell finjusterad för att hitta och åtgärda cybersäkerhetssårbarheter. Den är byggd ovanpå 3.5 Flash och är ihopkopplad med Googles CodeMender-agent, som använder flera Flash Cyber-agenter som arbetar tillsammans för att producera kombinerade säkerhetsrapporter.
På CyberGym benchmark når modellen konkurrenskraftiga prestanda vid gränsen. Med tanke på teknikens karaktär av dubbla användningsområden tar Google dock en medvetet försiktig inställning till implementeringen. Modellen kommer att vara exklusivt tillgänglig för regeringar och betrodda partners via CodeMender som en del av ett pilotprogram med begränsad tillgång.
Detta ger frontlinjeförsvarare ett försprång när det gäller att hitta och åtgärda kritiska sårbarheter innan de kan utnyttjas, samtidigt som risken för ett bredare missbruk minskar.
Gemini 3.5 Pro håller fortfarande på att testas
Google bekräftade att Gemini 3.5 Pro, flaggskeppsmodellen vars fördröjning har övervakats noga, för närvarande testar med partners och kommer att göras allmänt tillgänglig så snart den är klar. Företaget hade tidigare skjutit upp Pro-lanseringen på grund av interna prestationsmål och en våg av forskaravgångar.
Kanske mest anmärkningsvärt, Google avslöjade att teamet redan har påbörjat vad det beskrev som sin mest ambitiösa förträningskörning hittills för Gemini 4, vilket signalerar att nästa generations modeller redan är på gång.
Förbättrade säkerhetsåtgärder
Gemini 3.6 Flash levereras med förbättrade gränssäkerhetsgarantier inom områdena kemiska, biologiska, radiologiska och nukleära (CBRN) hot och missbruk av cyberbrott. Google säger att dessa säkerhetsåtgärder gör modellen avsevärt mer motståndskraftig mot jailbreaks samtidigt som den minimerar vägran för fördelaktig användning.
Utgivningen anländer mitt i en ökad granskning av säkerheten för AI-modeller i Washington, där Trump-administrationen har drivit företag att dela outgivna modeller med statliga testare innan den offentliggörs. Google DeepMind och Microsoft undertecknade båda avtal med regeringens Center for AI Standards and Innovation i maj 2026 för att dela sina gränsmodeller för nationella säkerhetstester.
Tillgänglighet
Gemini 3.6 Flash och 3.5 Flash-Lite är tillgängliga omedelbart för utvecklare genom Gemini API, Google AI Studio och Android Studio. Företagskunder kan komma åt dem via Gemini Enterprise Agent Platform. Gemini-appen stöder även båda modellerna för konsumentbruk, och 3.5 Flash-Lite rullas ut i Google Sök.
Ligg före AI
Vill du ha mer från världen av artificiell intelligens? Bokmärk AI Buzz Wire för den senaste AI-branschen du kan lita på.
Läs mer AI-nyheter →


