Google a anunțat marți Gemini 4 Argon, cel mai nou model de frontieră construit pentru munca profesională pe orizont lung în ingineria software, sarcinile de cunoaștere a întreprinderii și apărarea securității cibernetice. Scriind pe blogul oficial Google, Koray Kavukcuoglu, SVP Google DeepMind și Chief AI Architect, a declarat că modelul este implementat inițial către un set de apărători cibernetici de încredere prin Programul Fairwind de la Google, cu acces mai larg de urmat odată ce paravanele sunt consolidate.

Anunțul aterizează în una dintre cele mai aglomerate perioade ale anului pentru lansări de frontieră AI. Pentru o acoperire continuă a lansărilor de modele, a luptelor de politici și a rundelor de finanțare, AI Buzz Wire urmărește evoluțiile care contează pe măsură ce se întâmplă.

O lansare în etape, modelată de precauție

Spre deosebire de o lansare tipică a unui model major, majoritatea utilizatorilor nu pot încerca Argon astăzi. Google a declarat că este implicată în procesul voluntar al guvernului SUA pentru accesul la modele înainte de lansare și că va extinde treptat disponibilitatea, pe măsură ce feedbackul de la primii testeri îi va modela balustradele. Reuters a raportat că flagship-ul sosește după luni de întârzieri, iar VentureBeat a remarcat că strategia de lansare limitată permite încă Google să pretindă un avantaj reluat de referință față de OpenAI și Anthropic. Bloomberg a raportat un scepticism măsurabil cu privire la noul model în rândul angajaților Google înainte de lansare.

Când va veni un acces mai larg, Google a spus că va începe cu clienți API plătiți și abonați Google AI Ultra.

Ce spune Google că poate face Argon

Schimbarea principală a capacității este rezistența. Limita de jetoane de ieșire a Argon a fost extinsă la un milion de jetoane, lider în industrie, în creștere față de 64K anterioare. Google susține că oferind unui model spațiul de rațiune pentru sute de mii de jetoane într-o singură traiectorie îi permite să rezolve probleme dificile într-o singură trecere, mai degrabă decât să fragmenteze munca în sesiuni.

Google a publicat rezultate de referință pentru a susține afirmația de frontieră:

  • DeepSWE v1.1: 77,9% — o nouă ultimă generație în ceea ce privește standardul de inginerie software din lumea reală
  • Indexul Vals: nr. 1 — performanță de top în activitățile financiare, de codificare, juridice și fiscale ponderate în funcție de contribuția la PIB-ul SUA
  • AutomationBench: 51,3% — primul loc pe punctul de referință de execuție a afacerii de la Zapier
  • LVBench: 91,7% — stadiul tehnicii în înțelegerea videoclipurilor lungi
  • CWE-bench v1: 68% - la egalitate pe primul loc la remedierea vulnerabilităților de securitate

În cadrul propriilor fluxuri de lucru Google

Argon alimentează deja munca internă la Google, iar compania a oferit exemple neobișnuit de concrete. În ceea ce privește calculul cuantic, modelul a optimizat resursele spațiu-timp pentru subrutinele de blocaj, depășind valoarea de referință publicată cu 40% în câteva minute. Analizând telemetria de profilare la nivelul întregii flote, echipele de agenți Argon au identificat și aplicat optimizări ale memoriei în centrele de date Google care au eliberat peste 300 TiB odată lansate, cu o economie totală estimată la 500 TiB până la 1 PiB.

Modelul conduce, de asemenea, migrări de cod la scară largă de la C/C++ la Rust, scalând de la zeci de mii de linii în biblioteci de bază, cum ar fi re2 și libgav1, până la peste 800.000 de linii în nucleul Fuchsia Zircon. Pentru libgav1, decodorul video open-source de la Google, agenții Argon au înlocuit 32.000 de linii de cod SIMD cu Rust sigur pentru compilator, producând un decodor sigur pentru memorie care rulează de 2,7 ori mai rapid decât portul Rust anterior, cu o ieșire identică.

Apărarea securității cibernetice este pe primul loc

Argon a fost instruit în mod explicit pentru munca cibernetică defensivă: găsirea, validarea și corecția autonomă a vulnerabilităților software critice. Pentru apărătorii de încredere și echipele interne Google, compania va lansa modelul fără balustrade cibernetice, astfel încât apărătorii să aibă capacitatea deplină. Pe CWE-bench v1, care măsoară remedierea vulnerabilităților, Argon ocupă primul loc la 68%, bazându-se pe performanța de frontieră a 3.8 Flash Cyber, iar Google spune că Argon a depășit acel model în descoperirea suprafeței de atac și generarea de dovezi de concept pe testul de referință internă de penetrare a cutiei negre de la Wiz.

Firma de securitate Wiz folosește deja Argon prin inițiativa Scan for Good, care protejează gratuit infrastructura publică critică. Într-o demonstrație timpurie, Google spune că modelul a descoperit o vulnerabilitate critică care expune informații personale sensibile în software-ul de asistență medicală folosit de spitale din întreaga lume - un risc pe care modelele anterioare de frontieră nu l-au ratat.

Patru straturi de garanții la frontieră

Înainte de disponibilitatea largă, Google consolidează garanțiile în patru domenii. Împotriva utilizării greșite, Argon este conceput pentru a refuza solicitările de atac cibernetic și CBRN, păstrând în același timp cercetarea legitimă cu dublă utilizare, cu noi tehnici care monitorizează activările interne ale modelului pentru a detecta abuzurile. Împotriva injectării prompte, antrenamentul adversar a făcut ca modelul Argon Google cel mai rezistent de până acum, conducând la punctul de referință pentru injectarea promptă indirectă de la Grey Swan.

Pentru alinierea greșită, Google implementează măsuri de atenuare care monitorizează lanțul de gândire și acțiuni ale lui Argon, oprind execuția atunci când este necesar, cu alerte direcționate către o echipă dedicată de răspuns la incident. De asemenea, compania și-a întărit mediile de instruire și evaluare în sandbox, etanșându-le înainte de rulările cu risc ridicat. În special, Google a îndemnat restul industriei să păstreze transparența raționamentului, astfel încât gândurile modelului să rămână utile pentru diagnosticarea nealinierii.

Prețuri și disponibilitate

Argon se va lansa la un preț introductiv de 2 USD per milion de jetoane de intrare și 10 USD per milion de jetoane de ieșire, cu jetoane de intrare în cache la o reducere de 95% din prețul de intrare. După perioada introductivă, prețul crește la 4 USD per milion de jetoane de intrare și 20 USD per milion de jetoane de ieșire - poziționând Argonul agresiv față de ofertele rivale de frontieră.

Debutul în scenă reflectă o nouă realitate pentru lansările de frontieră: capacitatea este acum mize de masă, iar diferențiatorul demonstrează controlul. Google pariază că apărătorii cibernetici, software-ul spitalicesc și migrațiile Rust sunt vitrina potrivită - și că o lansare publică mai lentă costă mai puțin decât un alt incident de siguranță. Dezvoltatorii și întreprinderile ar trebui să fie atenți la fereastra de acces plătită la API și AI Ultra, despre care Google spune că se va deschide imediat ce testarea balustradei va permite.

---

Rămâneți înaintea AI

Obțineți cele mai recente știri, analize și descoperiri despre AI - toate într-un singur loc.

Citiți mai multe știri AI →