Anthropic imezindua OSS Scanner, huduma isiyolipishwa ya kuchagua kuingia inayotumia miundo thabiti zaidi ya kampuni ya AI - ikiwa ni pamoja na Claude Mythos - kukagua mara kwa mara miradi ya chanzo huria inayostahiki udhaifu wa kiusalama na kuwasilisha ripoti kamili za hitilafu zinazozalishwa na mfano moja kwa moja kwa watunzaji.

Huduma hiyo, iliyotangazwa Jumatano katika chapisho la blogu ya kampuni, ni zao la mabadiliko ya utulivu katika kazi ya usalama ya Anthropic: wanamitindo wake hivi karibuni wamekuwa wakipata udhaifu haraka zaidi kuliko timu ya usalama ya Anthropic inavyoweza kuzithibitisha. Kwa wasanidi programu wanaofuatilia zana za kuunda upya usalama wa programu, uzinduzi ni wakati muhimu kwa matumizi yetu ya maendeleo ya AI katika miundombinu huria.

Kutoka Mradi wa Glasswing hadi Utumishi wa Umma

Kichanganuzi cha OSS kinatambuliwa na uzoefu wa Anthropic wa kutumia Claude kuwinda udhaifu wakati wa Project Glasswing, juhudi za kampuni ya kugundua uwezekano wa kuathirika. Nambari kutoka kwa kazi hiyo zinaelezea kwa nini Anthropic inafungua bomba kwa umma.

Katika kipindi cha miezi sita iliyopita, Anthropic inasema miundo yake ya hivi punde ilikumbana na udhaifu wa watahiniwa zaidi ya 29,000 katika baadhi ya miradi muhimu ya programu ulimwenguni - lakini kampuni imeweza kukagua na kutathmini takriban 6,000 kati yao. Uwezo wa uthibitishaji wa binadamu, sio uwezo wa kielelezo, umekuwa kizuizi.

Upande wa mahitaji unasimulia hadithi sawa. Ripoti za kianthropic kwamba watunzaji wanaopokea ripoti zake za kwanza wanazidi kuuliza kila kitu ambacho kampuni inacho: karibu ripoti 5,000 tayari zimetumwa moja kwa moja kwa watunzaji ambao waliomba mawasilisho mengi ya matokeo ambayo hayajathibitishwa, viraka vilivyojumuishwa.

Muktadha wa uwezo ni mkali. Kwenye CyberGym, kigezo cha kupata udhaifu wa kitaaluma, modeli kubwa za lugha zimetoka katika kupata chini ya asilimia 20 ya udhaifu mwanzoni mwa mwaka jana hadi zaidi ya asilimia 85 mwaka huu, kulingana na Anthropic - mruko ambao umebadilisha ripoti za mdudu wa AI kutoka kelele hadi matokeo yanayoweza kutekelezeka.

Jinsi Namba Zilivyoshikamana Katika Upimaji

Kabla ya kuzinduliwa, Anthropic iliidhinisha bomba hilo kwa miradi mingi ya chanzo huria, ikitoa mamia ya ripoti za hitilafu - ikiwa ni pamoja na udhaifu ambao kampuni inasema inaweza kuunganishwa katika unyonyaji wa utekelezaji wa kanuni za mbali ambao haujaidhinishwa.

Mtihani unaojulikana zaidi ulihusisha uchunguzi wa nje. Anthropic iliwauliza wataalamu wa majaribio ya kupenya ambao hukagua matokeo yake ya ufichuzi ulioratibiwa wa hatari (CVD) kuchunguza matokeo 97 muhimu na ya ukali wa juu kutoka kwa kichanganuzi, kilichotolewa kutoka kwa miradi 48. Kati ya hao, 85 - asilimia 88 - walikutana na bar kwa mchakato wa CVD wa Anthropic. Kati ya 12 zilizosalia, 11 zilikuwa za kweli lakini zilirudufiwa masuala yanayojulikana au matokeo mengine kutoka kwa uchunguzi sawa. Moja tu ilikuwa chanya ya uwongo kabisa.

Kila ripoti, kampuni hiyo inasema, ina mtayarishaji anayejitosheleza na maelezo ya hatari, ikiwa ni pamoja na mgawanyiko wa kubainisha ni lini dosari hiyo ilianzishwa.

Biashara-Off: Kasi Zaidi ya Uhakika

Uamuzi mkuu wa muundo wa Kichanganuzi cha OSS pia ni hatari yake kubwa: ripoti zimetolewa kikamilifu, bila ukaguzi wa kibinadamu au utatuzi. Anthropic ni wazi kuwa hii huwezesha utambazaji wa haraka na wa mara kwa mara, lakini pia kwamba baadhi ya ripoti zitakuwa si sahihi au batili.

Kampuni inasimamia biashara hiyo kama msikivu kwa mahitaji ya watunzaji. Kwa kuwa ushujaa sasa unaweza kuendelezwa kwa dakika chache, miradi inazidi kupendelea kupokea kila matokeo ambayo hayajathibitishwa mara moja - pamoja na viraka vilivyopendekezwa kuambatishwa - kuliko kungoja uhakiki wa binadamu. Imehamasishwa na OSS-Fuzz ya Google, ambayo imechanganua programu-jalizi huria kwa miaka mingi, Kichanganuzi cha OSS kinatumia mantiki sawa kwa uchanganuzi wa msimbo unaoendeshwa na AI.

Miradi ambayo inapendelea utunzaji wa kitamaduni haijaachwa nje: Anthropic inasema itaendelea kufichua mwenyewe ripoti za hatari zilizothibitishwa na binadamu kupitia mchakato wake uliopo wa CVD, haswa kwa miradi isiyo na rasilimali ili kutathmini ripoti yenyewe. Wimbo wa hiari wa haraka unapatikana kwa wale wanaotaka matokeo ghafi mara tu yanapotolewa.

Nani Anaweza Kujiandikisha - na Nini Mengine Anthropic Iliyotangazwa

Wasimamizi wakuu wa miradi inayostahiki wanaweza kujiandikisha kwa kuwasilisha ombi la kuvuta kwenye hazina ya GitHub kufuatia kiolezo cha kawaida cha mradi. Vioo vya kustahiki vigezo vya OSS-Fuzz: miradi inapaswa kuwa na athari kubwa kwa miundombinu na usalama wa mtumiaji, huku uandikishaji ukiamuliwa kesi baada ya kesi.

Kichanganuzi hufika pamoja na seti pana ya mipango ya usalama ya Anthropic. Mpango wa kampuni ya Uthibitishaji wa Mtandao hufanya uwezo wa hali ya juu wa mtandao na kupunguza viainishaji vizuizi kupatikana kwa wataalamu wa usalama waliohitimu - mpango wa Anthropic uliopanuliwa mapema wiki hii kwa viwango vitatu vya ufikiaji wa Claude kwa timu za usalama. Claude tofauti kwa juhudi za OSS hutoa usajili wa Claude Max 20x bila malipo ili kusaidia watunzaji kurekebisha udhaifu na kuboresha miradi yao. SiliconANGLE pia iliripoti programu mpya ya Anthropic inayolenga kulinda miundombinu muhimu, ikitayarisha matangazo ya wiki kama msukumo ulioratibiwa katika usalama wa mtandao wa kiulinzi.

Inamaanisha Nini kwa Usalama wa Chanzo Huria

Ikiwa Kichanganuzi cha OSS kitafanya kazi kama inavyotangazwa, inaashiria mabadiliko ya kimuundo katika usalama wa chanzo huria: AI hupata hitilafu, na wanadamu huhama kutoka kwa uwindaji hadi uthibitishaji. Mabadiliko hayo husogeza mzigo halisi kwa watunzaji, ambao lazima wachunguze ripoti zinazozalishwa na mashine - baadhi yao sio sahihi - huku wakiamua kama wataamini viraka otomatiki.

Asilimia 88 ya kiwango cha uthibitishaji kinapendekeza uwiano wa mawimbi kwa kelele sasa ni mzuri vya kutosha kustahili muda wa mtunzaji, angalau kwa miradi muhimu ya miundombinu. Iwapo mfumo mpana zaidi wa ikolojia unakubali itaonyeshwa katika idadi ya waliojiandikisha - na ni miradi mingapi iliyojiandikisha iliyojiondoa kimya kimya baada ya ripoti nyingi za kwanza.

---

Kaa Mbele ya AI

Pata habari za hivi punde za AI, uchanganuzi na mafanikio - yote katika sehemu moja.

Soma habari zaidi za AI →