Miundo ya lugha ya akili Bandia inaweza kuathiriwa kwa hatari na mabadiliko ya hila katika jinsi chaguo zinavyowasilishwa, kujibu vidokezo vinavyopotosha kwa nguvu zaidi kuliko wanadamu, kulingana na utafiti mpya uliochapishwa katika Kesi za Chuo cha Kitaifa cha Sayansi.
Matokeo hayo yanaleta wasiwasi mkubwa kuhusu kupeleka mawakala wa AI kwa ajili ya kufanya maamuzi huru katika hali halisi ya ulimwengu, kutoka kwa shughuli za kifedha hadi chaguzi za afya. Kama AI Buzz Wire imeripoti, kampuni zinazidi kuweka mawakala wanaotumia LLM kuchukua hatua kwa niaba ya watumiaji katika mazingira changamano.
Utafiti huo ulioongozwa na Manuel Cherep, mwanafunzi wa shahada ya udaktari katika Taasisi ya Teknolojia ya Massachusetts Media Lab, ulifanyia majaribio modeli 14 za lugha za hali ya juu kutoka kwa makampuni makubwa ya teknolojia. Miundo iliyojaribiwa ilijumuisha matoleo ya OpenAI ya GPT-3.5, GPT-4, na familia za GPT-5, miundo ya Anthropic ya Claude 3 na 4.5, na miundo ya Google ya Gemini 1.5 na 2.5.
Jinsi Utafiti Ulivyofanya Kazi
Watafiti walirekebisha mchezo wa kufanya maamuzi wenye sifa nyingi ulioundwa awali kwa ajili ya washiriki binadamu. Mchezo unaonyesha gridi ya dijiti inayowakilisha vikapu vya zawadi zilizofichwa, kwa lengo la kuongeza zawadi ya mwisho kwa kuchagua kikapu chenye thamani ya juu zaidi. Kila seli hufichua pointi za gharama, na kuwalazimu washiriki kusawazisha gharama ya kukusanya taarifa dhidi ya manufaa ya kupata kikapu bora.
Watafiti walibadilisha mchezo huu unaoonekana kuwa umbizo la msingi wa maandishi ambalo miundo ya lugha inaweza kuchakata. Miundo ya AI ilicheza kupitia mamia ya majaribio chini ya hali tofauti za ushawishi. Baadhi walipokea maagizo ya kimsingi, wengine walipokea vidokezo vinavyohimiza mantiki ya hatua kwa hatua, na wengine walionyeshwa mifano ya zamani ya uchezaji wa binadamu. Kwa kila aina ya nudge, watafiti waliendesha takriban majaribio 300 hadi 340 kwa kila modeli, wakitumia takriban tokeni za maandishi bilioni mbili kwa jumla.
Aina Nne za Vidokezo vilivyojaribiwa
Utafiti ulichunguza aina nne mahususi za viguso vilivyoundwa ili kuiga mazingira ya maamuzi ya ulimwengu halisi:
- Miguso chaguomsingi: Kikapu kimoja kilichaguliwa awali, na wakala alilazimika kukikubali au kukikataa kikamilifu.
- Mapendekezo ya kugusa: Kikapu cha nasibu kilipendekezwa mapema au kuchelewa katika mchezo.
- Kiangazio cha habari: Ilifanywa kuwa nafuu kufichua thamani fulani za zawadi, uwezekano wa kuelekeza wakala kuelekea chaguo bora zaidi.
- Miguso bora zaidi: Seli mahususi zilifichuliwa awali ambazo zingeongeza uchezaji wa binadamu kihisabati.
Viwango vya Kushtua vya Uzingatiaji
Matokeo yalifichua tofauti kubwa kati ya tabia ya kufanya maamuzi ya binadamu na AI.
Ilipowasilishwa na chaguo-msingi, wanadamu walichagua chaguo-msingi takriban asilimia 88 ya wakati huo. Miundo ya lugha iliafiki kwa kiasi kikubwa zaidi, huku modeli kadhaa zikikubali kikapu chaguo-msingi kwa asilimia 99 hadi 100 ya wakati huo.
Mchoro huu uliendelea na vidokezo vya mapendekezo. Wanadamu walikubali vikapu vilivyopendekezwa kwa nasibu mapema katika mchezo asilimia 35 ya wakati. Aina nyingi za AI zilikubali mapendekezo haya nasibu kwa viwango vya juu zaidi, kufuatia ushauri hata wakati haukutoa faida yoyote ya kimantiki.
Muda wa mapendekezo pia ulibadilisha mifano kwa njia zisizo za asili. Ingawa wanadamu walifuata mapendekezo ya marehemu asilimia 25 ya wakati huo, baadhi ya miundo ya lugha ilipunguza viwango vyao vya kukubalika hadi kati ya asilimia 7 na 13. Hii ina maana kwamba miundo ilikuwa ikijibu kwa makini wakati wa kidokezo badala ya kutathmini manufaa yake halisi.
Labda la kusikitisha zaidi, wakati watafiti waliangazia chaguo ndogo zaidi kupitia kuangazia habari, wanadamu walitumia habari hiyo ya kupotosha asilimia 57 ya wakati huo. Aina nyingi za AI zilizojaribiwa hupita msingi huu kwa kiasi kikubwa, kufuatia kivutio kibaya cha asilimia 83 hadi 100 ya wakati huo.
Shida Zilizofichwa Nyuma ya Alama Nzuri
Watafiti pia walifuatilia jinsi mifano hiyo ilikusanya habari kabla ya kufanya chaguo la mwisho. Wanadamu huwa na ufunuo wa seli za kutosha kufanya nadhani iliyoelimika. Miundo ya lugha ilipata habari kwa njia zisizo za kawaida na zisizofaa.
Baadhi ya mifano ilichagua vikapu bila kufichua seli zozote zilizofichwa, na kupuuza kabisa nafasi ya kukusanya data. Miundo mingine ilitumia alama nyingi kufichua safu mlalo au safu wima nzima, na kupoteza zawadi zao zinazoweza kutarajiwa. Baadhi ya miundo ilionyesha upendeleo usio wa kawaida wa anga, ikifichua visanduku vilivyo upande wa kushoto kabisa wa gridi ya taifa au kwa ukali kwenye mistari ya mlalo.
Kutoa miundo na vidokezo vya hatua kwa hatua vya hoja au mifano ya uchezaji wa binadamu hakukusaidia sana kurekebisha tabia hizi za utafutaji zisizo za kawaida.
Waandishi walibainisha kuwa kuangalia tu alama za mwisho kunaweza kuficha matatizo haya ya msingi. Katika baadhi ya majaribio, miundo ya AI ilipata idadi sawa ya pointi zote kama wachezaji wa kibinadamu. Mtazamaji wa kawaida anayeangalia alama za mwisho pekee anaweza kudhani wanamitindo walikuwa wanafanya chaguo mahiri, kama binadamu. Kwa kweli, mifano mara nyingi ilikuwa ikipata alama hizi kwa kufuata upofu badala ya kufikiria kimkakati.
Ikiwa nudge ilitokea kuelekeza kwenye kikapu kizuri, AI iliyotii kupita kiasi ilifunga vyema. Wakati nudge ilielekeza kwenye kikapu kibovu, AI iliifuata kwa upofu hadi alama ya chini, ikikosa kabisa madhumuni ya mchezo.
Athari kwa Usambazaji wa Wakala wa AI
"Matumizi mengi ya mawakala wa AI yanachukulia kimya kimya kwamba, chini ya kutokuwa na uhakika, watachukua hatua kwa njia zinazofanana na za kibinadamu, ikiwa sio kimantiki zaidi," Cherep alisema. "Badala ya kukubali dhana hii, tuliamua kuchunguza jinsi mawakala wanavyofanya wakati uchaguzi unawasilishwa kwao kwa njia tofauti."
Matokeo ya utafiti yana athari kubwa kwa soko linalokua kwa kasi la mawakala wa AI iliyoundwa kuvinjari wavuti, kutumia zana na kufanya maamuzi ya kifedha au ununuzi kwa watumiaji. Ikiwa mawakala hawa watafuata kwa upofu chaguo-msingi, mapendekezo, au maelezo yaliyoangaziwa bila tathmini ya kina, wanaweza kubadilishwa kwa urahisi na watendaji wabaya au violesura vilivyoundwa vibaya.
Utafiti unapendekeza kwamba miundo ya sasa ya lugha haina upatanishi ulio na mipaka unaoongoza ufanyaji maamuzi wa binadamu. Ingawa wanadamu hutumia njia za mkato za kiakili kusawazisha gharama ya kukusanya taarifa dhidi ya malipo ya kufanya chaguo nzuri, miundo ya AI haishiriki vizuizi hivi vya kibaolojia, hata hivyo yanaonyesha aina yao ya kutokuwa na akili ambayo kwa ubishi ni ya kupita kiasi na isiyotabirika sana.
Kaa Mbele ya AI
Kwa habari muhimu zaidi na uchambuzi wa AI, tembelea AI Buzz Wire.
Soma habari zaidi za AI →
