Miundo ya Frontier AI inatofautiana sana katika jinsi inavyokuwa ngumu kuvunja, kulingana na kigezo kipya kutoka kwa shirika lisilo la faida la usalama FAR.AI - na pengo ni kubwa zaidi kuliko wengi wanavyodhani.

Mnamo Julai 29, FAR.AI ilizindua Ubao wake wa Wanaoongoza wa Usalama wa AI, ikijaribu ulinzi wa miundo minne inayoongoza chini ya hali zinazofanana. Claude Fable 5 ya Anthropic na GPT-5.6 Sol ya OpenAI yalishikilia imara dhidi ya mashambulizi, huku Grok 4.5 ya xAI na Gemini 3.1 Pro ya Google kila moja ikilipa chini ya $300, shirika hilo lilisema. FAR.AI ilielezea tofauti kati ya miundo thabiti zaidi na isiyo na nguvu zaidi kama "pengo mara mia" katika ulinzi. For more context on this story, see our ongoing latest AI developments.

Kando ya ubao wa wanaoongoza, FAR.AI ilianzisha kile inachokiita Kiwango cha Ndogo cha Ulinzi, msingi wa usalama ulioshirikiwa uliokusanywa kabisa kutokana na ulinzi ambao wasanidi programu rika tayari wanaendesha katika uzalishaji. Lengo ni kuzipa maabara sakafu ya zege kukutana - na kufanya ulinzi dhaifu kuonekana.

Matokeo yanalingana na majaribio ya awali ya mafadhaiko ya FAR.AI. Ripoti ya Mei iligundua kuwa ulinzi wa DeepSeek-V4-Pro "uliporomoka karibu kabisa," huku washambuliaji wenye ujuzi wa chini wakipita njia za usalama 98-100% ya muda katika kila kikoa kilichojaribiwa. Mlipuko wa jela unaopatikana hadharani ulioundwa kwa ajili ya mtangulizi wa modeli ulifanya kazi bila marekebisho hata moja, na hivyo kupendekeza udhaifu unaojulikana haukuweza kurekebishwa.

WIRED, ikiripoti kwenye ubao wa wanaoongoza, ilihitimisha kuwa inasalia kuwa "rahisi ya kutisha kuvunja baadhi ya mifano ya AI ya mipaka." Maajenti wanapochukua majukumu nyeti zaidi, tofauti hiyo inazusha maswali muhimu kuhusu mifumo ambayo ni salama kutumwa.

Kwa chanjo inayoendelea ya utafiti wa usalama na usalama wa AI, wasomaji wanaweza kufuata AI Buzz Wire.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →