Google v úterý oznámil Gemini 4 Argon, svůj nejnovější hraniční model vytvořený pro dlouhodobou profesionální práci v softwarovém inženýrství, podnikových znalostních úkolech a kybernetické obraně. Koray Kavukcuoglu, SVP společnosti Google DeepMind a hlavní architekt AI, na oficiálním blogu Google uvedl, že tento model bude zpočátku zaváděn skupině důvěryhodných kybernetických obránců prostřednictvím programu Fairwind společnosti Google s širším přístupem ke sledování, jakmile budou posíleny zábradlí.

Oznámení přichází během jednoho z nejrušnějších úseků roku pro vydání hraniční umělé inteligence. AI Buzz Wire sleduje vývoj, na kterém záleží, hned, jak k němu dojde, aby bylo zajištěno nepřetržité pokrytí uvedení modelů na trh, politických bojů a kol financování.

Postupné zavádění ve tvaru opatrnosti

Na rozdíl od typického uvedení velkého modelu si dnes většina uživatelů nemůže Argon vyzkoušet. Google uvedl, že je zapojen do dobrovolného procesu vlády USA pro přístup k modelu před vydáním a bude postupně rozšiřovat dostupnost, protože zpětná vazba od prvních testerů formuje jeho zábradlí. Agentura Reuters oznámila, že vlajková loď dorazí po měsících zpoždění, a VentureBeat poznamenal, že strategie omezeného vydání stále umožňuje Googlu získat znovu získaný náskok před OpenAI a Anthropic. Bloomberg ohlásil měřitelnou skepsi ohledně nového modelu mezi vlastními zaměstnanci Googlu ještě před jeho spuštěním.

Až přijde širší přístup, Google řekl, že začne s placenými zákazníky API a předplatiteli Google AI Ultra.

Co podle Googlu Argon dokáže

Hlavní změnou schopnosti je výdrž. Limit výstupních tokenů společnosti Argon byl rozšířen na špičkový 1 milion tokenů, což je nárůst z předchozích 64 tisíc. Google tvrdí, že když modelu poskytnete prostor pro uvažování napříč stovkami tisíc tokenů v jediné trajektorii, umožní mu to vyřešit těžké problémy v jednom průchodu, spíše než fragmentovat práci napříč relacemi.

Google zveřejnil výsledky srovnávacích testů na podporu tvrzení o hranicích:

  • DeepSWE v1.1: 77,9 % – nový stav techniky ve skutečném srovnání softwarového inženýrství
  • Vals Index: č. 1 – nejlepší výkon v oblasti financí, kódování, právní a daňové práce vážený příspěvkem k HDP USA
  • AutomationBench: 51,3 % – první místo v end-to-end benchmarku obchodní realizace Zapier
  • LVBench: 91,7 % — nejmodernější v porozumění dlouhému videu
– CWE-bench v1: 68 % – nerozhodně o prvenství při nápravě zranitelnosti zabezpečení

Uvnitř vlastních pracovních postupů Google

Argon již pohání interní práci v Googlu a společnost nabídla nezvykle konkrétní příklady. U kvantových výpočtů model optimalizoval časoprostorové zdroje pro podprogramy s úzkým hrdlem a během minut překonal publikovanou základní linii o 40 %. Při analýze telemetrie profilování v rámci celé flotily týmy agentů Argon identifikovaly a aplikovaly optimalizaci paměti napříč datovými centry Google, která po zavedení uvolnila více než 300 TiB, s odhadem 500 TiB až 1 PiB v celkových úsporách.

Model také řídí rozsáhlé migrace kódu z C/C++ do Rust, škálování od desítek tisíc řádků v základních knihovnách jako re2 a libgav1 až po více než 800 000 řádků v jádře Fuchsia Zircon. Pro libgav1, open-source video dekodér Google, agenti Argon nahradili 32 000 řádků SIMD kódu bezpečným Rustem, který je vhodný pro kompilátor, a vytvořili tak paměťově bezpečný dekodér, který běží 2,7krát rychleji než předchozí port Rust s identickým výstupem.

Kybernetická bezpečnost je na prvním místě

Argon byl výslovně vyškolen pro defenzivní kybernetickou práci: autonomně vyhledával, ověřoval a opravoval kritická zranitelnosti softwaru. Pro důvěryhodné obránce a interní týmy Google společnost uvolní model bez kybernetických zábradlí, takže obránci získají plnou kapacitu. Na CWE-bench v1, který měří nápravu zranitelnosti, se Argon drží na prvním místě se 68 %, staví na hraničním výkonu 3.8 Flash Cyber, a Google říká, že Argon tento model překonal v odhalování útočných ploch a generování proof-of-concept v interním testu penetrace Black-box společnosti Wiz.

Bezpečnostní firma Wiz již používá Argon prostřednictvím své iniciativy Scan for Good, která zdarma chrání kritickou veřejnou infrastrukturu. V první demonstraci Google říká, že model odhalil kritickou zranitelnost odhalující citlivé osobní informace ve zdravotnickém softwaru používaném nemocnicemi po celém světě – riziko, které předchozí hraniční modely přehlédly.

Čtyři vrstvy ochrany hranic

Před širokou dostupností Google posiluje zabezpečení ve čtyřech oblastech. Proti zneužití je Argon navržen tak, aby odmítal žádosti o kybernetické a CBRN útoky při zachování legitimního výzkumu dvojího použití s ​​novými technikami, které monitorují vnitřní aktivace modelu, aby odhalily zneužití. Proti rychlému vstřikování se díky tréninku protivníků stal dosud nejodolnější model společnosti Argon Google, který vede v benchmarku Indirect Prompt Injection společnosti Grey Swan.

V případě nesrovnalostí Google nasazuje zmírnění, která monitorují Argonův řetězec myšlenek a akcí, v případě potřeby zastavují provádění s upozorněními směrovanými na specializovaný tým pro reakci na incidenty. Společnost také posílila svá izolovaná školicí a hodnotící prostředí a uzavřela je před vysoce rizikovými běhy. Google zejména naléhal na zbytek odvětví, aby zachoval transparentnost uvažování, takže modelové myšlenky zůstaly užitečné pro diagnostiku nesouladu.

Cena a dostupnost

Argon bude uveden na trh za zaváděcí cenu 2 $ za milion vstupních tokenů a 10 $ za milion výstupních tokenů se vstupními tokeny uloženými v mezipaměti se slevou 95 % ze vstupní ceny. Po zaváděcím období cena stoupne na 4 $ za milion vstupních tokenů a 20 $ za milion výstupních tokenů, což Argon agresivně staví proti konkurenčním hraničním nabídkám.

Inscenovaný debut odráží novou realitu pro hraniční verze: schopnost je nyní sázka na stůl a rozlišovač demonstruje kontrolu. Google sází na to, že kybernetické obránce, nemocniční software a migrace Rustu jsou tou správnou ukázkou – a že pomalejší veřejné zavádění stojí méně než jiný bezpečnostní incident. Vývojáři a podniky by měli sledovat placené okno pro přístup k API a AI Ultra, které se podle Googlu otevře, jakmile to testování zábradlí dovolí.

---

Stay Ahead of AI

Získejte nejnovější zprávy, analýzy a průlomové informace o umělé inteligenci – vše na jednom místě.

Přečtěte si další zprávy o AI →