Google ještě nedokončil uvedení Gemini 4 Argon pro veřejnost, ale podle interních dokumentů, které byly přezkoumány Business Insider, společnost již testuje další věc: variantu Gemini 4 s kódovým označením Carbon, která vykazuje první známky souladu s nejsilnějším kódovacím modelem Anthropic.
Zpráva, publikovaná v pátek a podrobná The Decoder, popisuje dokumenty, snímky obrazovky a interní chaty, ve kterých zaměstnanci Google diskutují o třech vyvíjených variantách Gemini 4: Argon, Barium a Carbon. Pro čtenáře, kteří sledují hraniční modelový závod, je to nejnovější známka toho, že propast mezi generacemi modelů se hroutí do proudu aktualizací a naše modelové novinky sleduje každý jeho krok.
Uhlík už v Googlu běží
Podle Business Insider byl Carbon v posledních dnech nasazen na Jetski, interní kódovací platformě Google, a první uživatelé tvrdí, že je v programovacích úlohách primárně silnější než Argon. Jeden zaměstnanec porovnal Carbon s Claude Opus 5.5, nejsilnějším modelem kódování Anthropic, přičemž varoval, že model Google ještě potřebuje další testování, než toto srovnání bude znamenat mnoho.
Stejné dokumenty nabízejí vzácný pohled na to, jak Google pojmenovává a uskutečňuje svá hraniční vydání. Argon, současný hraniční model společnosti, měl dříve kódové označení "Barium-B" a zaměstnanec popsal Carbon interně jako "Gemini pro next model." To naznačuje, že Carbon a Barium jsou kontrolní body nebo kandidátské aktualizace v rámci rodiny Argon Frontier spíše než samostatné produktové vrstvy, i když dokumenty neuvádějí, zda Carbon bude nakonec dodáván jako aktualizace Argon nebo jako vlastní verze.
Ne všichni v Googlu jsou přesvědčeni, že nový model je čistým skokem vpřed. Rané verze Argonu připomínaly v některých úkolech kódování jinému zaměstnanci starší Opus 5, i když celkový interní příjem modelu byl hlášen jako pozitivní.
Proč Argon není bleskový model
Když byl Argon 30. září oznámen, objevily se spekulace, že by se mohlo jednat spíše o rychlostně optimalizovaný model třídy Flash než o vydání s maximálním výkonem. Google od té doby tuto teorii zakázal. V oznámení svého agenta Gemini pro Google Workspace společnost představila svou modelovou řadu podle účelu: Argon pro hraniční uvažování, Flash pro rychlost a objem, Omni pro generativní média a Gemma pro odlehčenou práci s otevřenými váhami.
Argon je proto nejsilnějším modelem uvažování Google, který společnost umístila vedle řady Anthropic Opus a OpenAI Astra. V současné době je k dispozici pouze omezené skupině důvěryhodných kybernetických obránců prostřednictvím programu Fairwind společnosti Google s cenou nastavenou na 2 $ za milion vstupních tokenů a 10 $ za milion výstupních tokenů a vstup z mezipaměti se slevou 95 procent.
'Rekurzivní sebezdokonalování' vtipy pište samy
Tempo vnitřní iterace nezůstalo bez povšimnutí. Vedant Misra, výzkumník Google DeepMind, odpověděl na zprávu Business Insider o X bodavým vtipem: "Už jste slyšeli o rekurzivním sebezdokonalování?" — odkaz na praxi používání systémů umělé inteligence za účelem vytvoření lepších systémů umělé inteligence. OpenAI a Anthropic oba oznámily podobnou dynamiku ve svých vlastních řadách, kde po sobě jdoucí generace modelů stále více pomáhají při výrobě jejich nástupců.
Zda je nebo není Carbon produktem této smyčky, prozrazuje kódové označení churn. Rychlý sled interních kontrolních bodů, každý testovaný proti hraničním rivalům během několika dní po nasazení, naznačuje, že Google industrializoval svůj proces vydávání způsobem, který komprimuje tradiční šesti až dvanáctiměsíční modelový cyklus.
Google již připravuje spouštěcí stroj
Stále neexistuje žádné oficiální datum pro širší uvedení Gemini 4, ale vlastní produkty Google se přestavují, aby uvolnily místo. V aplikaci Gemini uživatelé a testeři zaznamenali nový „Automatický“ režim pro modely řady 3 spolu s nastavitelným nastavením intenzity uvažování, která se pohybuje od nízké po vysokou. V Google AI Studio se objevil nový režim „Ultra“, který slibuje přístup k „pokročilým dovednostem a nástrojům“.
Logan Kilpatrick z Googlu veřejně potvrdil, že tým pracuje na tom, aby z Argonu vytěžil maximum, což je v souladu se vzorem, který popisují interní dokumenty: zasílejte hraniční model malému profesionálnímu publiku, pokračujte v iteraci oproti konkurenčním benchmarkům a rozšiřujte přístup, jak dozrávají zábradlí.
Na co se podívat dále
Následujících několik týdnů určí tři otázky. Za prvé, zda raný výkon kódování Carbonu obstojí v širším interním testování, nebo se vytratí tak, jak to někdy dělají slibné kontrolní body. Za druhé, zda Google rozšíří Argon mimo kybernetické obránce na vývojáře a spotřebitele – společnost pouze uvedla, že širší dostupnost přijde „co nejdříve“. Za třetí, jak reagují Anthropic a OpenAI: Opus 5.5 je referenčním bodem, který vlastní zaměstnanci společnosti Google používají pro porovnávání kódování, a konkurenční aktualizace Gemini by znovu zahájila soutěž o ceny a schopnosti, která již letos snížila náklady na modelování kódování.
Carbon zatím zůstává interním kódovým označením připojeným k snímkům obrazovky a protokolům chatu, nikoli oznámeným produktem. Ale směr jízdy je jasný. Google již nekonkuruje uváděním modelů na trh; konkuruje si tím, že je neustále nahrazuje.
Udržujte si náskok před AI
Úniky, starty a benchmarky hraničních modelů se objevují denně – třídíme signál od šumu.
Přečtěte si další zprávy o AI →