Google DeepMind släppte tre nya Gemini-modeller den 21 juli 2026, vilket stärker sitt sortiment för utvecklare som bygger AI-agenter i stor skala. Företaget levererade Gemini 3.6 Flash, Gemini 3.5 Flash-Lite och en specialiserad cybersäkerhetsmodell som heter Gemini 3.5 Flash Cyber. Ändå kom tillkännagivandet utan uppdateringen som de flesta observatörer väntade på: nästa version av Googles flaggskepp Gemini Pro. För fler brytande AI-nyheter och analys av gränsmodellracet, beskriver historien nedan vad som skickades, vad som halkade och varför det är viktigt.
Tre nya Flash-modeller riktar sig mot effektivitet och agenter
Gemini 3.6 Flash är positionerad som Googles "arbetshästmodell", utformad för att förbättra kodning, kunskapsarbete och multimodal prestanda samtidigt som tokenanvändningen minskar med upp till 17 procent jämfört med sin föregångare. Enligt TechCrunch gör modellen den billigare än Gemini 3.5 Flash samtidigt som den levererar starkare resultat över produktionsbelastningar.
Avkodaren rapporterade konkreta benchmarkvinster jämfört med den tidigare Flash-modellen. DeepSWE steg från 37 till 49 procent, MLE Bench klättrade från 49,7 till 63,9 procent, och OSWorld-Verified agentic benchmark förbättrades från 78,4 till 83 procent. Google prissatte 3,6 Flash till 1,50 USD per miljon inmatade tokens och 7,50 USD per miljon output-tokens.
Flash-Lite sänker priset
Gemini 3.5 Flash-Lite, den mest kostnadseffektiva modellen i klassen, är inställd för låg latens och hög genomströmning. Oberoende utvärderare Artificiell analys mätte att den producerade 350 utdatatokens per sekund. Det kostar $0,30 per miljon inmatade tokens och $2,50 per miljon output tokens, enligt avkodaren. Google säger att Flash-Lite slår den äldre 3 Flash på flera agent- och kodningsriktmärken.
Flash Cyber: En modell byggd för att jaga sårbarheter
Gemini 3.5 Flash Cyber är finjusterad för att hitta och åtgärda cybersäkerhetssårbarheter. Google har integrerat det i CodeMender, dess kodsäkerhetsagent. På CyberGym benchmark fick Flash Cyber 83,2 procent, inom två punkter från OpenAI:s GPT-5.5-Cyber på 85,6 procent, trots att den är en mycket mindre modell.
Googles Big Sleep-team implementerade Flash Cyber för att leta efter kritiska brister i Chrome och Safari. Vid skanning av commits i V8 JavaScript-motorn visade det sig 55 bekräftade unika fynd, jämfört med 47 för standard 3.5 Flash och 36 för Anthropics Claude Opus 4.6. I ett separat test använde Googles Cloud Vulnerability Research Team modellen för att skanna offentliga API:er, där den hittade fel vid fjärrkörning av kod inom två timmar och skapade en fungerande exploatering.
Eftersom modellen är effektiv för såväl anfall som försvar, begränsar Google åtkomsten. Flash Cyber är endast tillgängligt för regeringar och betrodda partners genom ett begränsat pilotprogram.
Var är Gemini 3.5 Pro?
Den iögonfallande frånvaron från lanseringen är Gemini 3.5 Pro, Googles flaggskeppsmodell för komplexa resonemang och kodning, som senast uppdaterades i februari. I maj retade Google Pro-versionen tillsammans med Gemini 3.5 Flash och sa att den "redan användes internt, och vi ser fram emot att släppa den nästa månad."
Den tidslinjen har halkat. Bloomberg rapporterade att Google stod inför interna förseningar i lanseringen av 3.5 Pro eftersom det kämpade för att nå sina egna prestationsmål. Google DeepMind produktledare Logan Kilpatrick sa den 21 juli att företaget testar 3.5 Pro med partners och hoppas att "landa snart", men erbjöd inget fast datum.
Rivaler väntar inte
Konkurrensklyftan ökar. TechCrunch noterar att sedan Google senast uppdaterade Pro har OpenAI släppt GPT-5.5 och börjat rulla ut GPT-5.6, medan Anthropic har lanserat Claude Opus 4.8, Claude Sonnet 5 och utökat tillgången till sin frontier Fable 5-modell. Kinesiska laboratorier närmar sig också: avkodaren pekar på Moonshots Kimi K3 och Zhipus GLM-5.2 som system som närmar sig gränsens prestanda.
Gemini 4-träning pågår
Kilpatrick avslöjade också att teamet har påbörjat sin mest ambitiösa förträningskörning hittills för Gemini 4. Avkodaren karakteriserade avslöjandet som skadekontroll och noterade att det signalerar att Google förstår marknadens förväntningar men ännu inte kan leverera sitt flaggskepp.
Google lade till nya funktioner till den bredare plattformen. Datoranvändning är nu ett inbyggt klientverktyg i Gemini API och Gemini Enterprise, vilket gör att modeller kan använda webbläsare och stationära datorer. Företaget lade också till starkare gränssäkerhetsgarantier mot kemiska, biologiska, radiologiska, nukleära och cyberhot.
Vad detta betyder för utvecklare
För byggare erbjuder de nya Flash-modellerna en pragmatisk blandning av hastighet, pris och kapacitet. Ett kontextfönster på en miljon token, agentiska riktmärken som visar verkliga vinster och aggressiva tokenpriser gör 3.6 Flash och Flash-Lite attraktiva för produktionsinstallationer. Cybersäkerhetsmodellen representerar samtidigt en anmärkningsvärd skjuts till en nisch med hög insats.
Den öppna frågan är hur länge Google kan upprätthålla en strategi för att leverera kapabla mellanklassmodeller medan dess flaggskepp testas. Med konkurrenter som släpper gränssystem på en jämn takt, ökar trycket på Gemini 3.5 Pro, och Gemini 4-träningsloppet bakom det, bara.
Ligg före AI
Gränsmodellloppet rör sig snabbt. Bokmärk AI Buzz Wire för daglig bevakning av modelllanseringar, benchmarks och branschskiften.
Läs mer AI-nyheter →

