Google ogłosiło we wtorek Gemini 4 Argon, swój najnowszy, pionierski model stworzony z myślą o długoterminowej pracy zawodowej w obszarach inżynierii oprogramowania, zadań związanych z wiedzą korporacyjną i obrony cyberbezpieczeństwa. Na oficjalnym blogu Google Koray Kavukcuoglu, wiceprezes Google DeepMind i główny architekt AI poinformował, że model zostanie początkowo udostępniony grupie zaufanych obrońców cybernetycznych w ramach programu Fairwind firmy Google, a po wzmocnieniu barier ochronnych będzie można go śledzić.
Ogłoszenie następuje w jednym z najbardziej pracowitych okresów roku w zakresie wydań pionierskich rozwiązań AI. Aby stale relacjonować premiery modeli, spory polityczne i rundy finansowania, AI Buzz Wire śledzi istotne wydarzenia na bieżąco.
Wdrażanie etapowe oparte na ostrożności
W przeciwieństwie do typowej premiery dużego modelu, większość użytkowników nie może dzisiaj wypróbować Argonu. Google oświadczyło, że uczestniczy w dobrowolnym procesie rządu USA dotyczącym dostępu do modeli przedpremierowych i będzie stopniowo zwiększać dostępność w miarę kształtowania się opinii pierwszych testerów. Reuters poinformował, że flagowiec pojawi się na rynku po miesiącach opóźnień, a VentureBeat zauważył, że strategia limitowanych wydań nadal pozwala Google odzyskać przewagę w benchmarkach nad OpenAI i Anthropic. Bloomberg zgłosił wymierny sceptycyzm wobec nowego modelu wśród pracowników Google jeszcze przed jego premierą.
Google powiedział, że gdy pojawi się szerszy dostęp, zacznie od klientów płatnych interfejsów API i subskrybentów Google AI Ultra.
Co według Google może zrobić argon
Główną zmianą w zakresie zdolności jest wytrzymałość. Limit tokenów wyjściowych Argon został zwiększony do wiodącego w branży 1 miliona tokenów, w porównaniu z poprzednimi 64 tys. Google argumentuje, że zapewnienie modelowi przestrzeni do rozumowania na podstawie setek tysięcy tokenów w jednej trajektorii pozwala mu rozwiązywać trudne problemy w jednym przebiegu, zamiast fragmentaryzować pracę między sesjami.
Google opublikowało wyniki testów porównawczych na poparcie twierdzenia o granicy:
- DeepSWE v1.1: 77,9% — nowy stan wiedzy w rzeczywistych testach porównawczych inżynierii oprogramowania
- Indeks Vals: nr 1 — czołowe wyniki w obszarach finansów, kodowania, prawa i podatków ważone wkładem w PKB USA
- AutomationBench: 51,3% — pierwsze miejsce w kompleksowym benchmarku realizacji biznesu Zapiera
- LVBench: 91,7% — najnowocześniejszy sposób rozumienia długich filmów
- CWE-bench v1: 68% — pierwsze miejsce w zakresie usuwania luk w zabezpieczeniach
Wewnątrz przepływów pracy Google
Argon napędza już prace wewnętrzne w Google, a firma podała niezwykle konkretne przykłady. W przypadku obliczeń kwantowych model zoptymalizował zasoby czasoprzestrzenne na potrzeby podprogramów stanowiących wąskie gardło, pokonując opublikowaną wartość bazową o 40% w ciągu kilku minut. Analizując dane telemetryczne profilowania całej floty, zespoły agentów Argon zidentyfikowały i zastosowały optymalizacje pamięci w centrach danych Google, które po wdrożeniu zwolniły ponad 300 TiB, co daje łączne oszczędności szacowane na 500 TiB do 1 PiB.
Model umożliwia także migrację kodu na dużą skalę z C/C++ do Rusta, skalując od dziesiątek tysięcy linii w podstawowych bibliotekach, takich jak re2 i libgav1, do ponad 800 000 linii w jądrze Fuchsia Zircon. W przypadku libgav1, dekodera wideo Google typu open source, agenci firmy Argon zastąpili 32 000 linii kodu SIMD przyjaznym dla kompilatora, bezpiecznym Rustem, tworząc bezpieczny dla pamięci dekoder, który działa 2,7 razy szybciej niż poprzedni port Rust z identycznym wyjściem.
Ochrona cyberbezpieczeństwa jest najważniejsza
Argon został specjalnie przeszkolony w zakresie defensywnej pracy w cyberprzestrzeni: samodzielnego znajdowania, sprawdzania poprawności i łatania krytycznych luk w zabezpieczeniach oprogramowania. Dla zaufanych obrońców i wewnętrznych zespołów Google firma udostępni model bez zabezpieczeń cybernetycznych, dzięki czemu obrońcy uzyskają pełne możliwości. W teście CWE v1, który mierzy usuwanie luk w zabezpieczeniach, Argon zajmuje pierwsze miejsce z wynikiem 68%, opierając się na granicznej wydajności 3.8 Flash Cyber, a Google twierdzi, że Argon uzyskał lepsze wyniki niż ten model w wykrywaniu powierzchni ataku i generowaniu dowodu słuszności koncepcji w wewnętrznym teście porównawczym testów penetracyjnych czarnej skrzynki firmy Wiz.
Firma ochroniarska Wiz już korzysta z Argonu w ramach inicjatywy Scan for Good, która bezpłatnie chroni krytyczną infrastrukturę publiczną. Google twierdzi, że we wczesnej demonstracji model odkrył krytyczną lukę w zabezpieczeniach ujawniającą wrażliwe dane osobowe w oprogramowaniu dla służby zdrowia używanym przez szpitale na całym świecie – ryzyko, które przeoczyło poprzednie pionierskie modele.
Cztery warstwy zabezpieczeń granicznych
Przed powszechną dostępnością Google wzmacnia zabezpieczenia w czterech obszarach. Rozwiązanie Argon zaprojektowano tak, aby zapobiegać nadużyciom i odrzucać żądania ataków cybernetycznych i CBRN, zachowując jednocześnie uzasadnione badania dotyczące podwójnego zastosowania, dzięki nowym technikom monitorującym wewnętrzne aktywacje modelu w celu wykrycia nadużyć. Dzięki szkoleniu kontradyktoryjnemu, który nie pozwala na natychmiastowe wstrzykiwanie, stał się on najbardziej odpornym modelem firmy Argon Google w historii, liderem w teście porównawczym Indirect Prompt Injection firmy Gray Swan.
W przypadku rozbieżności Google wdraża rozwiązania, które monitorują łańcuch myśli i działań firmy Argon, wstrzymując w razie potrzeby wykonanie, a alerty są kierowane do dedykowanego zespołu reagowania na incydenty. Firma wzmocniła także swoje środowiska szkoleniowe i ewaluacyjne w trybie piaskownicy, uszczelniając je przed uruchomieniami wysokiego ryzyka. W szczególności firma Google nalegała, aby reszta branży zachowała przejrzystość rozumowania, aby przemyślenia dotyczące modeli pozostały przydatne w diagnozowaniu niewspółosiowości.
Ceny i dostępność
Argon zostanie wprowadzony na rynek po początkowej cenie 2 USD za milion tokenów wejściowych i 10 USD za milion tokenów wyjściowych, przy czym tokeny wejściowe przechowywane w pamięci podręcznej będą tańsze o 95% od ceny wejściowej. Po okresie wstępnym cena wzrasta do 4 dolarów za milion tokenów wejściowych i 20 dolarów za milion tokenów wyjściowych, co pozycjonuje Argon agresywnie w stosunku do konkurencyjnych ofert granicznych.
Inscenizowany debiut odzwierciedla nową rzeczywistość w przypadku pionierskich wydawnictw: stawką są teraz możliwości, a wyróżnikiem jest wykazanie kontroli. Google obstawia, że cyberobrona, oprogramowanie szpitalne i migracja Rusta to właściwa wizytówka, a wolniejsze wdrożenie publiczne kosztuje mniej niż kolejny incydent związany z bezpieczeństwem. Programiści i przedsiębiorstwa powinni uważać na płatne okno dostępu do interfejsów API i AI Ultra, które według Google zostanie otwarte, gdy tylko pozwolą na to testy poręczy.
---
Wyprzedź sztuczną inteligencjęOtrzymuj najnowsze wiadomości, analizy i przełomowe informacje dotyczące sztucznej inteligencji — wszystko w jednym miejscu.
Przeczytaj więcej aktualności o sztucznej inteligencji →