Google ilitangaza Gemini 4 Argon Jumanne, muundo wake mpya kabisa wa mpaka uliojengwa kwa kazi ya kitaalamu ya muda mrefu katika uhandisi wa programu, kazi za maarifa ya biashara, na ulinzi wa usalama mtandao. Akiandika kwenye blogu rasmi ya Google, Koray Kavukcuoglu, SVP wa Google DeepMind na Mbunifu Mkuu wa AI, alisema mtindo huo unaanza kwa kundi la watetezi wa mtandao wanaoaminika kupitia Programu ya Google ya Fairwind, na ufikiaji mpana wa kufuata mara tu safu za ulinzi zitakapoimarishwa.

Tangazo hutua wakati wa kipindi cha shughuli nyingi zaidi cha mwaka kwa matoleo ya AI ya mipaka. Kwa utangazaji endelevu wa uzinduzi wa miundo, mapambano ya sera na raundi za ufadhili, AI Buzz Wire hufuatilia maendeleo muhimu kadri yanavyotokea.

Utoaji kwa awamu unaoundwa na tahadhari

Tofauti na uzinduzi wa mfano kuu wa kawaida, watumiaji wengi hawawezi kujaribu Argon leo. Google ilisema inajishughulisha na mchakato wa hiari wa serikali ya Marekani kwa ufikiaji wa muundo wa toleo la awali na itapanua upatikanaji hatua kwa hatua kadiri maoni kutoka kwa watumiaji wa majaribio ya mapema yanavyounda misimamo yake. Reuters iliripoti kuwa kinara hufika baada ya kucheleweshwa kwa miezi kadhaa, na VentureBeat ilibaini kuwa mkakati wa toleo pungufu bado unaruhusu Google kudai uongozi uliochukuliwa tena dhidi ya OpenAI na Anthropic. Bloomberg iliripoti shaka inayopimika kuhusu mtindo huo mpya miongoni mwa wafanyakazi wenyewe wa Google kabla ya kuzinduliwa.

Ufikiaji mpana unapokuja, Google ilisema itaanza na wateja wanaolipishwa wa API na waliojisajili kwenye Google AI Ultra.

Google inasema Argon anaweza kufanya

Mabadiliko ya uwezo wa kichwa ni uvumilivu. Kikomo cha tokeni cha Argon kimepanuliwa hadi tokeni milioni 1 zinazoongoza katika tasnia, kutoka 64K ya awali. Google hubishana kuwa kutoa modeli kichwa cha habari kusababu katika mamia ya maelfu ya ishara katika njia moja huiruhusu kutatua matatizo magumu kwa njia moja badala ya kugawanya kazi katika vipindi vyote.

Google ilichapisha matokeo ya kigezo ili kuunga mkono dai la mipaka:

  • DeepSWE v1.1: 77.9% - hali mpya ya kisasa kwenye kigezo cha uhandisi cha programu ya ulimwengu halisi
  • Kielezo cha Vals: Nambari 1 — utendaji unaoongoza katika masuala yote ya fedha, usimbaji, sheria na kodi inayopimwa kwa mchango kwa Pato la Taifa la Marekani
  • AutomationBench: 51.3% - nafasi ya kwanza kwenye benchmark ya utekelezaji ya biashara ya mwisho hadi mwisho ya Zapier
  • LVBench: 91.7% - hali ya juu katika uelewaji wa video ndefu
  • CWE-benchi v1: 68% — imefungwa kwa mara ya kwanza kwenye urekebishaji wa kuathirika kwa usalama

Ndani ya utendakazi wa Google

Argon tayari inawezesha kazi ya ndani katika Google, na kampuni ilitoa mifano halisi isiyo ya kawaida. Kwenye kompyuta ya kiasi, mtindo uliboresha rasilimali za muda wa angani kwa subroutines za vikwazo, na kushinda msingi uliochapishwa kwa 40% kwa dakika. Ikichanganua telemetry ya maelezo mafupi ya meli, timu za mawakala wa Argon zilitambua na kutumia uboreshaji wa kumbukumbu kwenye vituo vyote vya data vya Google ambavyo vilitoa zaidi ya 300 TiB mara tu ziliposambazwa, na akiba ya jumla ya 500 TiB hadi 1 PiB.

Muundo huu pia unaendesha uhamishaji wa msimbo wa kiwango kikubwa kutoka C/C++ hadi Rust, ukiongeza kutoka makumi ya maelfu ya mistari katika maktaba kuu kama vile re2 na libgav1 hadi zaidi ya mistari 800,000 kwenye Fuchsia Zircon kernel. Kwa libgav1, avkodare ya video huria ya Google, mawakala wa Argon walibadilisha mistari 32,000 ya msimbo wa SIMD na Rust salama isiyoweza kukumbukwa, ikitoa avkodare isiyohifadhi kumbukumbu ambayo hufanya kazi kwa kasi mara 2.7 kuliko lango la awali la Rust na utoaji sawa.

Ulinzi wa Cybersecurity ndio kwanza

Argon alifunzwa kwa uwazi kwa kazi ya utetezi ya mtandao: kutafuta kwa uhuru, kuhalalisha, na kuweka alama kwenye udhaifu muhimu wa programu. Kwa mabeki wanaoaminika na timu za ndani za Google, kampuni itatoa modeli bila cyber guardrails ili watetezi kupata uwezo kamili. Kwenye CWE-benchi v1, ambayo hupima urekebishaji wa uwezekano, mahusiano ya Argon kwa nafasi ya kwanza kwa 68%, ikitegemea utendakazi wa mipaka wa 3.8 Flash Cyber, na Google inasema Argon ilifanya vyema zaidi muundo huo katika ugunduzi wa uso wa mashambulizi na uundaji wa uthibitisho wa dhana kwenye kipimo cha ndani cha Wiz cha majaribio ya kupenya kwa kisanduku cheusi.

Kampuni ya ulinzi ya Wiz tayari inatumia Argon kupitia mpango wake wa Scan for Good, ambao hulinda miundombinu muhimu ya umma bila malipo. Katika onyesho la mapema, Google inasema modeli hiyo iligundua uwezekano mkubwa wa kufichua habari nyeti za kibinafsi kwenye programu ya huduma ya afya inayotumiwa na hospitali ulimwenguni kote - hatari ambayo mifano ya hapo awali ilikosa.

Safu nne za ulinzi wa mipaka

Kabla ya kupatikana kwa upana, Google inaimarisha ulinzi katika maeneo manne. Dhidi ya matumizi mabaya, Argon imeundwa kukataa maombi ya mashambulizi ya mtandaoni na CBRN huku ikihifadhi utafiti halali wa matumizi mawili, kwa mbinu mpya zinazofuatilia uanzishaji wa ndani wa modeli ili kuona matumizi mabaya. Dhidi ya udungaji wa papo hapo, mafunzo ya wapinzani yamefanya Argon Google kuwa modeli inayostahimili zaidi bado, ikiongoza kwa kipimo cha Uingizaji wa Moja kwa Moja cha Gray Swan.

Kwa upangaji mbaya, Google inapeleka vidhibiti vinavyofuatilia msururu wa mawazo na vitendo vya Argon, kusimamisha utekelezaji inapobidi, huku arifa zikipelekwa kwa timu maalum ya kukabiliana na matukio. Kampuni pia iliimarisha mazingira yake ya mafunzo na tathmini ya sanduku la mchanga, na kuyafunga kabla ya kukimbia kwa hatari kubwa. Hasa, Google ilihimiza tasnia nzima kuhifadhi uwazi wa hoja ili mawazo ya mfano yabaki kuwa muhimu kwa kugundua upotovu.

Bei na upatikanaji

Argon itazindua kwa bei ya utangulizi ya $ 2 kwa kila tokeni za pembejeo milioni na $ 10 kwa tokeni za pato milioni, na ishara za pembejeo zilizohifadhiwa kwa 95% kutoka kwa bei ya pembejeo. Baada ya kipindi cha utangulizi, bei hupanda hadi $4 kwa kila tokeni za pembejeo milioni na $20 kwa kila tokeni za pato milioni - kuweka Argon kwa ukali dhidi ya matoleo ya mipaka ya wapinzani.

Mechi ya kwanza kwa hatua inaonyesha ukweli mpya kwa matoleo ya mipaka: uwezo sasa ni vigingi vya meza, na kitofautishaji kinaonyesha udhibiti. Google inaweka dau kuwa watetezi wa mtandao, programu za hospitali, na uhamaji wa kutu ni onyesho sahihi - na kwamba uchapishaji wa polepole wa umma unagharimu chini ya tukio lingine la usalama. Wasanidi programu na makampuni ya biashara wanapaswa kutazama dirisha la ufikiaji la API na AI Ultra inayolipishwa, ambalo Google inasema litafunguliwa mara tu majaribio ya guardrail yatakaporuhusu.

---

Kaa Mbele ya AI

Pata habari za hivi punde za AI, uchanganuzi na mafanikio - yote katika sehemu moja.

Soma habari zaidi za AI →