Perplexity imezindua Portable Computer, toleo la jukwaa lake la mawakala la "Kompyuta" ambalo linaendeshwa na watumiaji wa maunzi ambao tayari wanamiliki - kwa kuanzia na kompyuta kuu ya kompyuta ya mezani ya DGX Spark ya Nvidia na mashine za Linux zilizo na RTX GPU. Imetengenezwa kwa ushirikiano wa karibu na Nvidia na kutangazwa tarehe 25 Agosti 2026, ni mojawapo ya majaribio makali zaidi ya kuhamisha mzigo mkubwa wa wakala wa AI kutoka kwenye wingu na kwenye vifaa vya ndani.

Mchoro ni rahisi lakini wa matokeo: mfano, faili za mtumiaji, na kazi yenyewe inaweza kukaa kwenye mashine. Kazi iliyokamilishwa ndani ya nchi haitumii salio la bili, kila kazi huanza kwenye kifaa kwa chaguomsingi, na mfumo huomba ruhusa kabla ya kutuma hatua yoyote mahususi kwa muundo wa mipaka wenye nguvu zaidi katika wingu. For more context on this story, see our ongoing breaking AI news.

"Kwa kweli tumeleta UI sawa kwa programu ya ndani kabisa," Nate, makamu wa rais wa uhandisi wa miundombinu na biashara wa Perplexity, wakati wa mkutano na waandishi wa habari Jumatatu. "Hii inajumuisha jumla ya uunganisho wa wakala na uelekezaji na kila kitu kinachohitajika kufanya kazi ndani ya nchi."

Kwa Nvidia, ambayo imetumia miaka miwili iliyopita kuuza ulimwengu kwenye vituo vya data vya AI vya dola trilioni, tangazo hilo lina ujumbe wa hila: mtengenezaji wa chip anaamini AI ya ndani imevuka kizingiti kutoka kwa udadisi wa hobbyist hadi zana ya vitendo. "AI ya ndani ilifikia kiwango cha ubadilishaji," Nader, mkurugenzi wa teknolojia ya wasanidi wa Nvidia alisema. "Kwa muda mrefu zaidi, walikuwa wapenda hobby na wapenda... kuendesha wanamitindo hawa waliokaguliwa kupunguzwa hadi kuwa vidogo sana. Na ingawa hiyo ni nzuri, si ya vitendo vya hali ya juu. Lakini yote hayo yalibadilika kutokana na mifano mingi hii mipya ya chanzo wazi."

Rafu Kamili ya AI ya Ndani katika Programu Moja

Kompyuta ya Kushangaa, bidhaa ya wingu, hupanga miundo, faili, zana, na ufikiaji wa wavuti ili kukamilisha kazi za maarifa ya hatua nyingi - kukagua folda za hati, kuchanganua data na kutoa ripoti. Kompyuta Kubebeka inaiga ile ya ndani, ikiunganisha miundo ya ndani, kuunganisha wakala, injini ya marejeleo, zana, viunganishi vya programu, na kisanduku cha usalama cha usalama kwenye programu moja. Kuunganisha ni muhimu: pamoja na rafu nyingi za ndani za AI leo, watumiaji lazima wakusanye vipande hivyo wenyewe - kupakua uzani, kusimamisha seva ya makisio, na zana za kuunganisha waya pamoja.

Katika onyesho la vyombo vya habari, mfumo ulicheza mwekezaji wa reja reja anayekagua folda ya miaka ya 1099 na hati za uwekezaji - aina ya nyenzo nyeti za kifedha watumiaji wengi wangesita kupakia kwenye huduma ya wingu. Akiendesha muundo wa Qwen wa kigezo cha bilioni 27 kwa matumizi kamili ya GPU kwenye DGX Spark, wakala aliripoti kesi ambapo mwekezaji alikuwa akilipa ada zisizo za lazima. Kipengele cha kiolesura ambacho kwa kawaida huhesabu salio la wingu, Perplexity ilibainishwa, "kimeegeshwa tu kwa sifuri."

Bidhaa pia ni mseto badala ya hermetic. Onyesho la pili lilichanganua CSV ya data ya faneli ya mtumiaji ndani ya nchi, kisha ikasukuma uchanganuzi uliokamilika hadi kwa Slack kwa kutumia mfumo wa kiunganishi wa Perplexity. Mfumo huu huunganishwa kwenye Hifadhi ya Google, Gmail, na GitHub, na unaweza kupanda hadi muundo wa wingu wa mipaka wakati muundo wa ndani unafikia kikomo.

Mahitaji na Upatikanaji

Wakati wa kuzinduliwa, watumiaji wanaweza kuendesha Qwen 3.8 27B au PPLX 27B - toleo la Perplexity limefunzwa baada ya kutumia kifaa chake chenyewe - huku umeme wa Nemotron 3.5 wa Nvidia unakuja hivi karibuni. Mfumo hutumia vLLM kupangisha makisio chini yake, na hali ya juu kwa watumiaji wanaotaka kuchomeka sehemu zao za mwisho. GPU yoyote ya RTX iliyo na angalau 24GB ya VRAM, takriban GeForce RTX 3090 au mpya zaidi, husafisha upau.

Kompyuta Kubebeka inapatikana sasa kwa wateja wa Pro, Max, Enterprise Pro, na Enterprise Max kwenye Linux, huku usaidizi wa Windows ukifuata mwezi wa Septemba.

Kuunda Pamoja Mfano na Kuunganisha

Kando ya uzinduzi huo, Perplexity ilichapisha karatasi ya utafiti inayosema kwamba mawakala wa ndani wanaofaa wanahitaji muundo na uunganisho wa wakala - kiunzi cha maongozi, zana, na mantiki ya okestration - kuundwa pamoja. Viunga vya madhumuni ya jumla huchukua miundo ya mipaka inayoweza kunyonya miktadha mikubwa na kusogeza kwenye nyuso za zana zinazosambaa; mifano ndogo ya ndani hufungamana chini ya mahitaji hayo. Wasiwasi uligundua kuwa ingawa Qwen 3.8 27B inatangaza dirisha la muktadha wa ishara 260,000, inaanza kutatizika zaidi ya tokeni 100,000.

Jibu la kampuni ni uunganisho mdogo kimakusudi: kidokezo cha mfumo fupi, seti ndogo ya zana za msingi, na uwezo ambao hupakia na kupakua kama "ujuzi" unaohitajika. Ilibadilisha viunganishi maarufu kama vile Gmail na GitHub kutoka seva za MCP zenye njaa ya ishara hadi zana fupi za mstari wa amri, iliongeza ndoano za uthibitishaji binafsi, na kutekeleza sandboxing ya kiwango cha OS kila mara - ikiwa sandbox haipatikani, kuunganisha hujizima yenyewe badala ya kuendesha zana bila ulinzi.

Matokeo ya kigezo Ripoti za utata zinavutia, ingawa zinatoka kwa tathmini za kampuni yenyewe. Kwenye benchi lake la ndani la Kazi ya Maarifa ya Ndani - kazi 53 zinazohusu utafiti wa kina, uchanganuzi wa kifedha, na uundaji wa hati, ambao Perplexity inapanga kufungua chanzo - Kompyuta inayoendesha Qwen 3.8 27B kwenye DGX Spark ilipata 82.6%, dhidi ya 77.6% kwa zana huria ya Pi na 74.0% kwa muundo wa Hermes. Perplexity's baada ya mafunzo ya PPLX 27B ilisukuma alama hadi 85.4%. Kwenye BrowseComp, kipimo cha utafiti wa wavuti, Kompyuta iligonga usahihi wa 66.7% dhidi ya 50.2% ya Pi na 43.9% ya Hermes, huku ikitumia 51% chini ya muda wa ukuta na 70% tokeni chache kuliko Pi.

The Token Economics Driving Agents Karibu Nawe

Mantiki ya kimkakati inakuwa wazi katika jinsi mzigo wa kazi wa AI umebadilika. Gumzo lilikuwa la kupasuka - swali, jibu, limefanywa. Mawakala huendesha kwa saa. "Ukiwa na mawakala, unataka mawakala hawa wawashwe kila wakati ikiwa unaweza... Tunachoona ni hitaji lisilotosheka la tokeni, na hilo ni jambo ambalo hufanya AI ya ndani kuwa nzuri," Nader alisema. "Hukupimwa kwa ishara. Hukuwa unalipia ishara."

Msingi wa mseto wa kati unaweza kuwa matokeo ya kuvutia zaidi kibiashara. Kwenye benchi ya Terminal 2.1, kiwango cha changamoto cha usimbaji, mtindo wa Qwen wa ndani kabisa ulipata 59.6% kwa gharama ya sifuri. Kuiruhusu kuongezeka hadi kwa "mshauri" wa Claude Opus 5 kwenye wingu ilipandisha alama hadi 73.0% kwa makadirio ya $0.415 kwa kila kazi, huku akiendesha mfano wa mipaka pekee alipata 82.4% kwa $0.65 kwa kila kazi. Kupanda kulipata takribani theluthi tatu ya pengo la utendakazi wa mipaka kwa takriban theluthi mbili ya gharama - na mtumiaji ndiye anayeamua ni lini biashara inafaa kufanywa. Kabla ya simu yoyote ya mshauri, kuunganisha huendesha kiainishaji cha PII juu ya muktadha unaotoka na humwonyesha mtumiaji kile ambacho kingeacha kifaa; muundo wa mbali hurejesha mwongozo wa maandishi pekee na kamwe haugusi faili au zana za ndani.

Nvidia pia alisisitiza kuwa mizani ya maunzi zaidi ya kisanduku kimoja: kuunganisha Spark mbili za DGX juu ya kumbukumbu iliyoshirikiwa huendesha mifano ya wazi ya kiwango cha mipaka kama ya hivi punde ya DeepSeek, nne zinaweza kuendesha GLM 5.2 au Nemotron Ultra, na Nader alisema "hata ameona Cheche nane zikiunganishwa."

Uzinduzi huo unapanua ushirikiano ambao umekuwa ukijengwa kwa zaidi ya mwaka mmoja, baada ya Nvidia na Perplexity kutangaza ushirikiano huru wa AI kwa wachapishaji na mawasiliano wa Ulaya mnamo Juni 2025. Kwa watengenezaji wanaopima rundo la DIY la Ollama, viunga vilivyo wazi, na uelekezaji unaojipangisha, dau la Kompyuta ya Kubebeka ni kwamba matumizi ya kifaa, muundo wa mchanga ni nini - muundo wa ndani - muundo wa ndani - muundo wa mchanga. wakala AI tawala.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →