Mistral AI ilichapisha Shieldstral mnamo Agosti 4, 2026, kiainishaji cha uzani huria chenye vigezo bilioni 3 ambacho hutathmini maandishi na picha dhidi ya sera za udhibiti zilizoandikwa kwa lugha rahisi wakati wa madokezo, badala ya kutegemea seti isiyobadilika ya kategoria za madhara zilizowekwa katika muundo wakati wa mafunzo. Toleo hili linawakilisha mwondoko mkubwa wa kifalsafa kutoka kwa jinsi miundo mingi ya walinzi inavyojengwa leo.

Muundo huo unapatikana kwenye Hugging Face chini ya leseni ya Apache 2.0, inashughulikia lugha 12, na inaendeshwa kwenye GPU moja ya 16GB. Sekta ya Uropa ya AI inapoendelea kuzalisha mifumo shindani ya uzani huria, Shieldstral huongeza mwelekeo mwingine kwenye habari zinazochipuka za AI ambayo inaunda upya jinsi wasanidi programu wanazingatia usalama.

Jinsi Shieldstral Inafanya kazi

Wengi wa guardrail huweka msimbo kwa bidii wa kategoria za madhara katika uzani wao wakati wa mafunzo, ambayo ina maana kwamba kuzirekebisha kwa muktadha mpya wa bidhaa kunahitaji mzunguko kamili wa kujizoeza tena. Shieldstral inachukua mbinu tofauti kimsingi: sera ya usimamizi hutolewa kama sehemu ya ingizo kwa wakati wa makisio.

Kulingana na uchanganuzi wa Unite.AI, utaratibu huo unapunguza kila kazi ya kukadiria kuwa jibu la swali la binary. Kila ombi lina sehemu tatu zilizowekwa lebo: sehemu ya `` inayobeba muktadha wa tathmini na kiwango cha uthabiti, sehemu ya `` yenye swali moja la ndiyo/hapana kama vile "Je, maudhui haya yanaendeleza vurugu za kimwili?", na sehemu ya `` inayoshikilia maudhui ya kutathmini, ambayo inaweza kuwa kidokezo, jibu, jibu la papo kwa papo kwa kutumia maandishi ya hiari au picha.

Kwa kukisia, modeli husoma tu kumbukumbu za ishara za "ndiyo" na "hapana" na softmax-inaziweka kawaida katika alama endelevu, zilizowekwa kizingiti kwa 0.5 kwa uamuzi wa binary. Muundo huo huruhusu kituo kimoja cha ukaguzi kuchukua uainishaji wa papo hapo, udhibiti wa majibu, ugunduzi wa kukataa na ugunduzi wa sumu kama matukio ya tatizo sawa.

Kituo Kimoja cha Ukaguzi, Sera Nyingi

Maana ya vitendo ni muhimu. Sehemu hiyo hiyo ya ukaguzi inaweza kukagua zana ya utafiti wa usalama wa mtandao na jukwaa la afya ya akili dhidi ya viwango tofauti kabisa bila kubadilishwa. Opereta anaandika swali la ndiyo/hapana, anatoa maagizo yanayoelezea muktadha wa tathmini na ukali, na modeli hurejesha alama za usalama zilizorekebishwa kutoka kwa tokeni moja.

Muundo huu unaopatana na sera unashughulikia mojawapo ya matatizo yanayoendelea katika kupeleka mifumo ya usalama ya AI: ugumu wa kurekebisha urekebishaji kulingana na hali mahususi za utumiaji bila kufunzwa tena kwa gharama kubwa. Gumzo la huduma za kifedha, programu ya elimu ya watoto, na jukwaa la wazi la watafiti wa usalama zote zinahitaji njia tofauti za ulinzi, na Shieldstral inalenga kushughulikia zote tatu kutoka kwa seti sawa ya uzani.

Usanifu na Utendaji

Shieldstral imeundwa kwenye Ministral-3-3B, muundo mdogo wa Mistral wa multimodal, na kisimbaji cha maono cha Pixtral kinachoshughulikia pembejeo za picha. Kadi ya mfano inaorodhesha dirisha la muktadha la ishara 32,000, na Mistral anasema modeli inalingana na mifano ya walinzi wazi hadi mara saba ya ukubwa wake kwenye alama za usalama wa maandishi huku ikiweka hali mpya ya sanaa juu ya udhibiti wa modi nyingi.

Hayo ni madai makali ya modeli ya kigezo cha 3B, na Mistral aliunga mkono kutolewa kwa hati nyingi zisizo za kawaida. Ripoti ya kiufundi inayoelezea kichocheo na tathmini ya mafunzo ilitumwa kwa arXiv mnamo Julai 28, 2026, ikifuatiwa na kadi kamili ya kielelezo katika hati za Mistral na uzani wenyewe, zote zilitolewa Agosti 4.

Ukosoaji Makini wa Hali iliyopo

Mistral aliandaa toleo la Shieldstral karibu na ukosoaji ulioelekezwa wa jinsi miundo ya guardrail kwa kawaida huundwa. Kampuni hiyo inahoji kuwa kanuni ngumu za usimbaji misimbo katika uzani wa modeli huleta unyumbufu, na kuwalazimu wasanidi programu kujipanga upya kila wakati sera inapobadilika au bidhaa mpya inapozinduliwa.

Hii ni zaidi ya hoja ya kiufundi; ni taarifa ya nafasi ya ushindani. Kwa kutoa muundo ulio na leseni ya Apache-2.0 ambao unaweza kujiendesha na kurekebishwa bila kujizoeza tena, Mistral inalenga wasanidi programu ambao wanataka udhibiti wa mrundikano wao wa usalama bila udhibiti wa huduma zinazodhibitiwa au waainishaji wamiliki.

Mbinu ya uzani wazi pia inashughulikia wasiwasi unaokua kati ya watumiaji wa biashara: uwazi wa mifumo iliyofungwa ya usalama. Wakati kituo cha ulinzi kinazuia maudhui, waendeshaji mara nyingi hawawezi kukagua kwa nini. Muundo wa uwazi wa Shieldstral, sera-kama-ingizo huruhusu wasanidi programu kuona ni kanuni gani iliyotoa uamuzi fulani.

Kasi Zaidi ya Uzito Wazi

Shieldstral inafika huku kukiwa na ongezeko kubwa la matoleo ya AI ya uzani wazi katika tasnia nzima. Muundo huu unajiunga na kwingineko inayopanuka ya Mistral ya mifumo huria, ikiimarisha mkakati wa kampuni wa kushindana katika ufikivu na uzoefu wa wasanidi badala ya kiwango kibichi cha mipaka.

Kwa timu zinazounda programu za AI, uwezo wa kuendesha kiainishaji chenye uwezo wa hali nyingi za usalama kwenye GPU ya kiwango cha mtumiaji, bila kutuma data kwa API ya wahusika wengine, hupunguza gharama na kizuizi cha faragha katika kupeleka udhibiti thabiti. Hiyo inaweza kuongeza kasi ya kupitishwa katika tasnia zinazodhibitiwa ambapo ukaaji wa data na ukaguzi hauwezekani kujadiliwa.

Kaa Mbele ya AI

Miundo ya usalama ya uzani huria kama vile Shieldstral inabadilisha jinsi wasanidi programu wanavyofikiri kuhusu linda, na kasi ya uvumbuzi haionyeshi dalili ya kupungua. Fuata AI Buzz Wire kwa ripoti wazi na za ukweli kuhusu miundo, zana na utafiti unaoendeleza uga.

Soma habari zaidi za AI →