Nvidia imeweka kiongeza kasi chake cha maingiliano cha Groq 3 LPX katika uzalishaji kamili, kampuni ilitangaza mnamo Agosti 24, 2026, wakati wa mkutano wa Hot Chips. Chip, kiendelezi cha jukwaa la Nvidia la Vera Rubin, iliwasilisha rekodi ya tokeni 3,400 kwa sekunde katika ulinganishaji wa Uchanganuzi Bandia wakati wa kuendesha modeli ya chanzo huria ya Gemma 4 31B yenye dirisha amilifu la tokeni 100,000 - utendaji wa haraka zaidi kuwahi kurekodiwa kwa modeli hiyo.

Uzinduzi huo unaashiria hatua muhimu zaidi ya bidhaa bado kutoka kwa ununuzi wa Nvidia wa dola bilioni 20 wa mtaalamu wa uelekezaji Groq, mpango ambao kampuni sasa inaelekea kuunufaisha kama mahitaji ya kuongezeka kwa ufahamu wa chini. CNBC iliripoti kuwa Nvidia anasema raki za kwanza za Groq zitakuwa mtandaoni kabla ya mwisho wa mwaka. Kwa muktadha zaidi kuhusu hadithi hii, angalia utangazaji wetu wa tasnia ya AI.

Kwa nini Kasi ya Kizazi cha Tokeni ni muhimu

Mifumo ya AI ya Kiajenti - programu zinazosababisha, zana za kupiga simu, kuandika na kujaribu nambari, na kurudia katika mamia au maelfu ya hatua za uelekezaji - hutoa idadi kubwa ya tokeni za matokeo. Kasi ambayo tokeni hizo hutolewa, inayojulikana kama mwingiliano au upitishaji wa msimbo, huamua jinsi wakala anaweza kukamilisha haraka kila hatua ya kazi yake.

Nvidia anasema Groq 3 LPX hutoa mwitikio wa haraka wa 4x kwa mawakala na mizigo ya kazi nyeti kwa muda kuliko jukwaa mbadala la karibu zaidi. Katika uwekaji tofauti tofauti, mifumo ya Vera Rubin NVL72 hushughulikia umezaji wa muktadha na ukokotoaji wa kujaza mapema, huku vitengo vya Groq 3 LPX vikichakata awamu ya uzalishaji wa tokeni nyeti kwa muda.

"Inference ni injini ya ukuaji wa AI," Jensen Huang, mwanzilishi na Mkurugenzi Mtendaji wa Nvidia, alisema katika tangazo hilo. "Vera Rubin anapanua maono hayo kwa usanidi wa kiwanda cha AI ulioboreshwa kwa mzigo wa kazi iliyoundwa kwa ajili ya enzi ya AI ya mawakala, na kuendeleza utendakazi wa mipaka kwa LPX kwa ajili ya kuzalisha tokeni haraka sana."

Ndani ya Vifaa

Kulingana na uchanganuzi wa kiufundi wa StorageReview, kila trei ya 2U iliyopozwa kioevu hubeba Groq 3 LPU kumi na sita pamoja na CPU mwenyeji, mantiki ya upanuzi wa kitambaa, na DRAM, pamoja na BlueField-4 DPU au kadi ya mtandao ya ConnectX-9. Trei ina viungo 32 vya LPU vya chip-to-chip na 400Gb/s Ethaneti kwenye paneli ya mbele.

Katika kiwango cha rack, uwekaji wa Groq 3 LPX hujumuisha hadi vichapuzi 256 vya LP30 vilivyounganishwa kupitia viunganishi vya kasi ya juu, vya moja kwa moja vya chip-to-chip. Racks kwenye miundombinu ya kiwanda cha Nvidia ya Vera Rubin AI pana zaidi, ambayo kampuni inaelezea kama jukwaa lake kubwa zaidi kuwahi kutokea: chipsi saba tofauti katika usanidi wa rack tano uliojengwa kwa kusudi, pamoja na BlueField-4 DPUs, raki za Vera CPU, uhifadhi wa Vera BlueField-4 STX, na mtandao wa Spectrum-6 SPX Ethernet.

Nvidia pia ilionyesha upya madai yake ya utendakazi wa kiwango cha jukwaa, ikisema kwamba Vera Rubin NVL72 inatoa hadi mara 30 ya upitishaji wa tokeni kwa kila megawati ikilinganishwa na GB300 NVL72 kwenye mzigo wa usimbaji wa mawakala wa alama 140,000, huku faida ikiongezeka kadri malengo ya mwingiliano wa kila mtumiaji yanavyoongezeka.

Alama Yenye Nyota

Kichwa cha habari 3,400 tokeni kwa sekunde takwimu huja na tahadhari muhimu kuzingatiwa. Kama StorageReview ilivyoonyesha, matokeo ya Nvidia yalipimwa kwa mwisho wa toleo la kibinafsi mnamo Agosti 21, wakati nambari zinazoshindana ililinganishwa dhidi yake zinatoka kwa sehemu za mwisho za uzalishaji bila seva. Utendaji wa ulimwengu halisi kwenye huduma zinazopatikana kwa ujumla unaweza kutofautiana na usanidi wa benchmark ya kuweka rekodi.

Bado, shirika huru la uchanganuzi Bandia lilirekodi matokeo kama ya haraka zaidi kuwahi kupimwa kwa Gemma 4 31B katika urefu huo wa muktadha, na madai ya msingi - kwamba silicon iliyobuniwa kwa kusudi inaweza kuharakisha awamu ya kusimbua ya uelekezaji - inalingana na jinsi tasnia imekuwa ikisanifu upya kwa mzigo wa kazi wa mawakala.

Kuasili kwa Wingu Kunaanza

Nebius, wingu la AI lenye makao yake makuu Amsterdam, ndiye mtoa huduma wa kwanza kujitolea kupeleka Groq 3 LPX, akipanga kuileta katika Nebius Token Factory, jukwaa lake la makisio ya uzalishaji.

"Kizazi ni awamu ya uelekezaji ambayo huamua jinsi mfumo wa AI unavyofanya kazi, na hivyo ndivyo NVIDIA Groq 3 LPX inavyoundwa ili kuharakisha," alisema Danila Shtan, afisa mkuu wa teknolojia wa Nebius. "Kama wingu la kwanza la AI likileta kwa uzalishaji kupitia Nebius Token Factory, tunahakikisha kuwa kila hatua ya kitanzi cha wakala inahisi papo hapo - kupitia watengenezaji API sawa tayari wanatumia, bila kuhama hadi kwa rundo jipya."

Mtoa huduma wa uelekezaji Groq, ambaye sasa ni sehemu ya familia ya Nvidia, anapanga kuwa miongoni mwa watumiaji wa kwanza wa jukwaa.

Picha Kubwa

Tangazo la utayarishaji kamili linaashiria jinsi soko la miundombinu ya AI limebadilika kwa kasi kutoka kwa mafunzo hadi makisio. Kadiri makampuni ya biashara yanavyobadilisha bajeti kutoka kwa mtindo mbichi wa mafunzo ya awali kuelekea mawazo ya wakati halisi na upangaji wa wakala unaojiendesha, uchumi wa tokeni - jinsi inavyoweza kuzalishwa na kwa gharama gani ya nishati - imekuwa uwanja mkuu wa ushindani.

Kwa Nvidia, Groq 3 LPX inapanua utetezi wa franchise ya kiwanda chake cha AI wakati ambapo silikoni maalum kutoka kwa watoa huduma za wingu na wanaoanzisha vile vile inafuatilia mzigo wa kazi wa maelekezo ya mawakala. Racks zinazokuja mtandaoni mwaka huu, kama CNBC ilivyoripoti, ingeweka mifumo ya kwanza ya uzalishaji mikononi mwa wateja miezi kadhaa baada ya upataji kufungwa - muunganisho wa haraka wa viwango vya tasnia ya semiconductor.

Kampuni haikufichua bei ya mifumo hiyo mipya. Groq 3 LPX itatolewa kwa misingi ya lini na-ikiwa-inapatikana kupitia washirika wa wingu wa AI, huku Nebius akitarajiwa kuwa wa kwanza kutoa ufikiaji kwa wasanidi programu kupitia ncha zake zilizopo za API.

---

Kaa Mbele ya AI

Pata habari za hivi punde za AI, uchanganuzi na mafanikio - yote katika sehemu moja.

Soma habari zaidi za AI →