Google tillkännagav Gemini 4 Argon på tisdagen, dess senaste frontiermodell byggd för professionellt arbete med lång horisont inom mjukvaruteknik, kunskapsuppgifter för företag och cybersäkerhetsförsvar. Koray Kavukcuoglu, SVP för Google DeepMind och Chief AI Architect, skrev på den officiella Google-bloggen, att modellen rullas ut initialt till en uppsättning pålitliga cyberförsvarare genom Googles Fairwind-program, med bredare tillgång att följa när skyddsräcken har stärkts.

Tillkännagivandet landar under en av årets mest trafikerade sträckor för frontier AI-släpp. AI Buzz Wire spårar utvecklingen som är viktig när den sker för kontinuerlig bevakning av modelllanseringar, policystrider och finansieringsrundor.

En gradvis lansering formad av försiktighet

Till skillnad från en typisk lansering av större modeller kan de flesta användare inte prova Argon idag. Google sa att det är engagerat i den amerikanska regeringens frivilliga process för tillgång till pre-release modell och gradvis kommer att utöka tillgängligheten när feedback från tidiga testare formar dess skyddsräcken. Reuters rapporterade att flaggskeppet anländer efter månader av förseningar, och VentureBeat noterade att strategin med begränsad utgåva fortfarande tillåter Google att göra anspråk på ett återtaget benchmark-försprång över OpenAI och Anthropic. Bloomberg rapporterade mätbar skepsis mot den nya modellen bland Googles egna anställda inför lanseringen.

När bredare tillgång kommer, sa Google att det kommer att börja med betalda API-kunder och Google AI Ultra-prenumeranter.

Vad Google säger att Argon kan göra

Rubrikens förmågasförändring är uthållighet. Argons output token-gräns har utökats till en branschledande 1 miljon tokens, upp från de tidigare 64K. Google hävdar att genom att ge en modell utrymme för att resonera över hundratusentals tokens i en enda bana kan den lösa svåra problem i ett steg snarare än att fragmentera arbetet över sessioner.

Google publicerade benchmarkresultat för att stödja gränskravet:

  • DeepSWE v1.1: 77,9% — ett nytt toppmodernt riktmärke för mjukvaruutveckling
  • Vals Index: nr 1 — ledande resultat inom ekonomi, kodning, juridiskt och skattearbete viktat efter bidrag till USA:s BNP
  • AutomationBench: 51,3% — första plats på Zapiers jämförelseindex för företagsutförande.
  • LVBench: 91,7% — toppmoderna för förståelse av långa videor
  • CWE-bench v1: 68% — rankad först när det gäller åtgärdande av säkerhetssårbarheter

Inuti Googles egna arbetsflöden

Argon driver redan internt arbete på Google, och företaget erbjöd ovanligt konkreta exempel. På kvantberäkningar optimerade modellen rumtidsresurser för flaskhalsunderrutiner, och slog en publicerad baslinje med 40 % på minuter. Genom att analysera profiltelemetri för hela flottan identifierade och tillämpade team av Argon-agenter minnesoptimeringar i Googles datacenter som frigjorde över 300 TiB när de rullades ut, med uppskattningsvis 500 TiB till 1 PiB i totala besparingar.

Modellen driver också storskaliga kodmigreringar från C/C++ till Rust och skalar från tiotusentals rader i kärnbibliotek som re2 och libgav1 upp till mer än 800 000 rader i Fuchsia Zircon-kärnan. För libgav1, Googles videoavkodare med öppen källkod, ersatte Argon-agenter 32 000 rader SIMD-kod med en kompilatorvänlig säker Rust, vilket producerade en minnessäker avkodare som går 2,7 gånger snabbare än den tidigare Rust-porten med identisk utgång.

Cybersäkerhetsförsvar kommer först

Argon utbildades uttryckligen för defensivt cyberarbete: att självständigt hitta, validera och korrigera kritiska sårbarheter i programvara. För pålitliga försvarare och Googles interna team kommer företaget att släppa modellen utan cyberskydd så att försvarare får full kapacitet. På CWE-bench v1, som mäter sårbarhetsavhjälpning, hamnar Argon på förstaplatsen på 68 %, som bygger på gränsöverskridande prestanda för 3.8 Flash Cyber, och Google säger att Argon överträffade den modellen när det gäller upptäckt av attackytor och generering av proof-of-concept på Wiz:s interna benchmark för penetrationstestning av svart låda.

Säkerhetsföretaget Wiz använder redan Argon genom sitt Scan for Good-initiativ, som skyddar kritisk offentlig infrastruktur gratis. I en tidig demonstration säger Google att modellen avslöjade en kritisk sårbarhet som exponerade känslig personlig information i sjukvårdsprogramvara som används av sjukhus över hela världen - en risk som tidigare gränsmodeller hade missat.

Fyra lager av gränsskydd

Innan bred tillgänglighet stärker Google skyddsåtgärder inom fyra områden. Mot missbruk är Argon designad för att avslå cyber- och CBRN-attackförfrågningar samtidigt som legitim forskning med dubbla användningsområden bevaras, med nya tekniker som övervakar modellens interna aktiveringar för att upptäcka missbruk. Mot snabb injektion har motståndskraftig utbildning gjort Argon till Googles mest motståndskraftiga modell hittills, ledande på Grey Swans riktmärke för Indirect Prompt Injection.

För felanpassning använder Google åtgärder som övervakar Argons tankekedja och handlingar, stoppar genomförandet vid behov, med varningar som skickas till ett dedikerat incidentresponsteam. Företaget har också hårdnat sina sandlådor för träning och utvärderingsmiljöer och förseglat dem innan högriskkörningar. Speciellt uppmanade Google resten av branschen att bevara insyn i resonemang så att modelltankar förblir användbara för att diagnostisera felinriktning.

Priser och tillgänglighet

Argon kommer att lanseras till ett introduktionspris på 2 USD per miljon inmatade tokens och 10 USD per miljon output-tokens, med cachade indatatokens till 95 % rabatt på ingångspriset. Efter introduktionsperioden stiger priset till $4 per miljon inmatade tokens och $20 per miljon output-tokens – vilket positionerar Argon aggressivt mot rivaliserande gränserbjudanden.

Den iscensatta debuten återspeglar en ny verklighet för gränsöverskridande utgåvor: kapacitet är nu bordssatsningar, och differentiatorn visar kontroll. Google satsar på att cyberförsvarare, sjukhusmjukvara och Rust-migreringar är rätt skyltfönster – och att en långsammare offentlig utbyggnad kostar mindre än en annan säkerhetsincident. Utvecklare och företag bör hålla utkik efter det betalda API- och AI Ultra-åtkomstfönstret, som Google säger kommer att öppnas så snart skyddsräckstestning tillåter.

---

Stay ahead of AI

Få de senaste AI-nyheterna, analyserna och genombrotten – allt på ett ställe.

Läs mer AI-nyheter →