Google har släppt Gemini 3.7 Flash, som beskriver modellen som dess mest intelligenta arbetshäst hittills för kodning och agentarbetsflöden. Lanseringen kommer bara tre veckor efter Gemini 3.6 Flash och levererar betydande förbättringar inom mjukvaruutveckling, kunskapsarbete och webbutveckling. Besök AI Buzz Wire för fler senaste AI-nyheter och branschanalyser.

Vad är nytt i Gemini 3.7 Flash

Enligt Googles officiella tillkännagivande är 3.7 Flash-releasen ett direkt resultat av feedback från utvecklare och nya algoritmiska innovationer som företaget planerar att ta med till framtida modeller. Modellen visar stora vinster jämfört med sin föregångare i kodningsuppgifter inklusive felsökning och problemlösning, med högre förstapassagekodnoggrannhet och förbättrad prestanda vid generering av produktionsklar kod.

På FrontierCode 1.1 Main benchmark får 3,7 Flash 43,6 %, upp från 34,4 % på 3,6 Flash. På DeepSWE v1.1, som utvärderar verkliga programvarutekniska uppgifter, hoppar modellen från 49,0 % till 65,3 %.

Webbutveckling och kunskapsarbete

För webbutveckling säger Google att 3.7 Flash genererar mer funktionella layouter och funktionskompletta applikationer med färre uppmaningar. Modellen uppvisar hög designefterlevnad när den matchar UI-utdata mot referensingångar som skärmdumpar, bilder eller fullständiga designsystem. På Arena.ai:s WebDev Arena får 3.7 Flash en Elo-poäng på 1588, jämfört med 1538 för den tidigare versionen.

Inom kunskapstäta områden, inklusive finans, juridik och biovetenskap, ger modellen förbättrade resonemang och noggrannhet. På GDP.pdf-riktmärket, som testar en modells förmåga att bearbeta komplexa dokument, får 3,7 Flash 34,0 % jämfört med 22,0 % för 3,6 Flash. På AutomationBench, som mäter färdigställandet av verkliga arbetsflöden, förbättras det från 17,0 % till 30,4 %.

Prisstrategi: Halva kostnaden

En av de mest anmärkningsvärda aspekterna av releasen är dess prissättning. Gemini 3.7 Flash är tillgängligt till ett introduktionspris på 0,75 USD per miljon inmatade tokens och 3,75 USD per miljon output-tokens, exakt hälften av den ursprungliga kostnaden för 3,6 Flash. Denna prissättning är tillgänglig till slutet av 2026, varefter standardpriser på 1,50 USD per miljon inmatade tokens och 7,50 USD per miljon output-tokens kommer att gälla från och med den 1 januari 2027.

Google positionerar detta som att göra det möjligt för utvecklare och kunder att skala produktionsklara agenter kostnadseffektivt och kombinera förbättrad prestanda med låg kostnad.

Förbättrad utvecklarupplevelse

Utöver råa riktmärken lyfter Google fram betydelsefulla förbättringar av utvecklarupplevelsen. Modellen anpassar sig bättre till vägspärrar, förtydligar avsikt vid behov och följer instruktioner med större trohet. Den tänker mer flitigt, investerar mer ansträngning i flerstegsplanering och verktygsanrop, vilket resulterar i mer disciplinerat utförande med mindre manuell tillsyn och färre omförsök över tekniska arbetsflöden.

Gemini Spark Upgrade

Gemini Spark, Googles personliga AI-agent tillgänglig för Google AI Pro- och Ultra-prenumeranter i över 160 länder, körs nu på Gemini 3.7 Flash. Google beskriver Spark som en 24/7-agent som vidtar åtgärder på uppdrag av användare under deras ledning. Modelluppdateringen gör Spark mer effektiv för kunskapsarbete, med förbättrad verktygsanvändning för Google Workspace-applikationer och bättre noggrannhet för komplexa arbetsflöden med flera färdigheter.

Säkerhet och skyddsåtgärder

Gemini 3.7 Flash levereras med uppdaterade skyddsåtgärder mot missbruk i domäner relaterade till kemiska, biologiska, radiologiska och nukleära (CBRN) hot och cyberbrott, samtidigt som det möjliggör fördelaktiga användningsfall. Google säger att dessa skydd är i linje med dess syn på bioresiliens och dess cyberprogram.

Den bredare konkurrenskraftiga bilden

Releasen kommer mitt i en intensifierad kamp om AI-utvecklingsmarknaden. Googles betoning på att kombinera kodning på gränsnivå och agentprestanda med aggressiv prissättning sätter press på konkurrenter som Anthropic, OpenAI och xAI. Med DeepSeek som just har släppt sin V4 Pro-modell och xAI som lanserar Grok 4.6, positionerar Google helt klart 3.7 Flash som modellutvecklarna bör sträcka sig efter när de behöver kapabel kodning och agentprestanda utan att bryta budgeten.

Den snabba treveckorskadensen mellan 3,6 Flash och 3,7 Flash signalerar också Googles engagemang för iterativ förbättring av höghastighetsmodeller för sin mid-tier lineup.

Ligg före AI

För den senaste AI-utvecklingen, modellsläppen och branschanalyser, bokmärk AI Buzz Wire.

Läs mer AI-nyheter →