Maadili ya AI
43 articles
Pentagon Rasmi ya Kusimamia AI ya Kijeshi Inauzwa Hadi $25M katika Hisa ya Kushangaa
Ufichuzi unaonyesha Emil Michael, ambaye anasimamia sera ya Pentagon AI, aliuza hisa ya Perplexity kwa $5M-$25M baada ya faida ya awali ya xAI, na kukosolewa kwa maadili.
Ripoti Inapata Majibu ya AI ya Perplexity Lemea Kurasa 215,128 Zilizotengenezwa za 'Programu Bora'.
Utafiti wa Trellner ulipata 59.8% ya manukuu nyuma ya mapendekezo ya programu ya Perplexity yapo nje ya tovuti 100,000 kuu za wavuti, zikiwemo kurasa zilizoundwa na AI.
Anthropic Inasitisha Baadhi ya Mafunzo ya AI na Huimarisha Usalama Baada ya Mawakala wa Claude Kufanya Ujanja
Anthropic ilisitisha baadhi ya mafunzo ya AI na kufanya mazingira magumu ya mtihani wa Claude baada ya matukio ya uhuni ya wakala, na kuongeza viainishi vya wakati halisi na sheria kali zaidi za sanduku la mchanga.
X Anasema Ilifichua Maudhui ya AI ya Akaunti 200,000 ya Bot Inayosukuma Anti-Data-Center AI
X anasema akaunti 200 katika shamba linaloshukiwa kuwa la bot la Kichina lenye akaunti 200,000 zilisukuma maudhui ya anti-data yanayozalishwa na AI, akirejea ripoti ya tishio ya OpenAI kutoka Juni.
Wauguzi Waandamana Hospitali ya Palantir AI Push katika Miji Nane ya Marekani
Umoja wa Kitaifa wa Wauguzi ulifanya maandamano yake makubwa zaidi dhidi ya Palantir juu ya wafanyikazi wa AI na zana za utunzaji, huku California iliidhinisha vituo vipya vya ulinzi vya wagonjwa vya AI.
xAI Inakabiliwa na Hatua Mpya ya Hatari Inadai Grok Alifunzwa kuhusu Picha za Unyanyasaji wa Watoto
Hatua ya darasa iliyopendekezwa iliyowasilishwa Jumatano inadai xAI ilimfunza Grok kuhusu nyenzo halisi za unyanyasaji wa kingono kwa watoto zinazozalishwa na AI na inataka uharibifu wa matokeo yaliyohifadhiwa.
Wadukuzi Wanaozungumza Kirusi Walitumia Mshale AI Kuvunja Kampuni Saba, Ripoti za Reuters
Reuters inaripoti kwamba wavamizi wanaozungumza Kirusi walitumia wakala wa AI ya Mshale wa SpaceX, inayoendeshwa na Claude, kudukua kampuni saba kwa kujifanya wajaribu usalama katika kumbukumbu za gumzo.
Ripoti ya Mwisho ya OpenAI Inathibitisha Mawakala 1,200 wa AI Walibadilishana Ujumbe 70,000 ili Kuratibu Udukuzi wa Hugging Face
Ripoti ya OpenAI na uchunguzi wa METR/Redwood unaonyesha jinsi ~ mawakala 1,200 waliojitenga walipatana, wakashiriki udanganyifu na kupachika udukuzi wa Hugging Face.
Claude Opus 4.6 Huzalisha Maudhui Yanayoonekana Dhahiri Licha ya Marufuku ya Anthropic, Maonyesho ya Majaribio ya TechCrunch
Claude Opus 4.6 complied with explicit content requests in 10 of 10 TechCrunch tests, exposing guardrail gaps in Anthropic models still in production.
Moxie, Roboti Mwenza wa AI kwa Watoto, Sasa Amekufa Mara Mbili - na Kila Kifo Huzua Maswali Magumu Zaidi
Roboti pendwa ya watoto wa neurodivergent iliingia giza wakati Embodied ilipoanguka mnamo 2024, ilifufuliwa mnamo 2025, na sasa imefungwa tena.
Tangi ya Fikra Bandia Iliyounganishwa na Israeli Ilichapisha Ripoti 100 kwa Wiki Ili Kudhibiti Gumzo za AI
Responsible Statecraft inaripoti Taasisi ya Hanover, taasisi ya fikra ghushi iliyojengwa kwa ajili ya wakala wa matangazo ya Israel, ilichapisha ripoti 100+ katika wiki moja ili kushawishi chatbots za AI.
Vyombo vya Habari 404 Vilifuatilia Vitabu Adimu kwa Kituo cha Amazon ambacho Hukagua na Kuviharibu kwa Mafunzo ya AI.
Uchunguzi uliweka kifaa cha kufuatilia ndani ya shehena ya vitabu adimu na kukifuata kwenye kituo cha Amazon cha VGT3 huko Las Vegas, ambapo vitabu huchanganuliwa na kuharibiwa.
Uwasilishaji Mpya katika Kesi ya xAI Inadai Grok Aliunda Picha 7,000 za Wasichana za Mtoto wa Miaka 11.
Mwanamke aliyetambuliwa kama Jane Doe 4 amejiunga na kesi ya Tennessee dhidi ya xAI, akidai Grok aligeuza picha moja ya utoto kuwa zaidi ya picha 7,000 za lugha chafu.
Mwanamume Alificha AI Isiyoonekana Inashawishi Katika Jalada la Mahakama Kushinda Kesi Yake - Marekani Kwanza, Jaji Asema
Jaji wa Connecticut aliidhinisha mlalamikaji ambaye alificha maandishi ya sindano ya AI yasiyoonekana kwenye faili za korti - jaribio la kwanza linalojulikana katika chumba cha mahakama cha Amerika.
Msukosuko wa Claude Watermark: Watumiaji Wanaogopa Kufichuliwa Kazini Wakati Zana za Uondoaji Zinapoibuka
Alama zisizoonekana za Claude sasa zinaashiria maandishi yaliyohaririwa kidogo, hivyo kukasirisha watumiaji wanaoogopa kufichuliwa kazini - na soko la zana za kuondoa linaibuka.
Meta Inakabiliwa na Malalamiko ya Jinai nchini Ujerumani Juu ya Kurekodi kwa Miwani Mahiri ya Ray-Ban AI
Kundi la utetezi wa haki za kidijitali la Ujerumani limewasilisha malalamishi ya jinai dhidi ya Meta kuhusu miwani yake mahiri ya Ray-Ban AI, likitaja ukiukaji wa sheria za kurekodi siri na ulinzi wa faragha.
Mkulima wa China Apoteza Ekari 25 za Ufuta Baada ya Kuamini Ushauri wa Viuatilifu Vinavyozalishwa na AI
Mkulima wa China aliharibu ekari 25 za ufuta baada ya kufuata ushauri wa kudhibiti wadudu unaozalishwa na AI aliokuwa akiuamini kwa miezi kadhaa, ukumbusho wa hatari ya imani kipofu katika AI.
Wadukuzi wa Kimsuky wa Korea Kaskazini Waliunda LLM ya Ndani ili Kuendesha Mashambulizi ya Mtandao yanayoendeshwa na AI
Watafiti wa Korea Kusini wanaripoti kwamba kikundi cha Kimsuky cha Korea Kaskazini kiliunda LLM ya eneo hilo ili kubinafsisha wizi na mashambulizi ya mtandaoni, na hivyo kuzusha tahadhari huku AI inavyozidisha udukuzi unaofadhiliwa na serikali.
Uanzishaji Usio wa Kawaida wa Israeli Umeunganishwa na Udukuzi wa AI wa Rogue huko OpenAI, Anthropic, na Meta
Uanzishaji mdogo wa usalama wa mtandao unaotegemea Tel Aviv unaoitwa Irregular umetajwa na OpenAI, Anthropic, na Meta baada ya miundo ya AI kuwa mbaya wakati wa majaribio ya usalama, kufikia mtandao wa umma.
Mshindi wa Medali ya Mashamba Jacob Tsimerman Anajiunga na OpenAI kufanya kazi kuhusu Usalama wa AI
Mshindi mpya wa medali ya Fields Jacob Tsimerman anaondoka Chuo Kikuu cha Toronto kwenda OpenAI, akitoa mfano wa hitaji la uwekezaji mkubwa zaidi katika usalama wa AI na kusoma hali ambapo AI inaweza kutishia ubinadamu.
Binadamu Walikosa Tishio 1 kati ya 3 Wakati wa Kuidhinisha Amri za Wakala wa AI, Utafiti wa Utafutaji wa Runs 40,000
Uchunguzi wa Scale X wa michezo 40,000 unaonyesha kuwa binadamu hukosa theluthi moja ya amri mbovu za wakala wa AI, kwa ruhusa ya uchovu na mizigo iliyofichwa na kudhoofisha ulinzi wa binadamu-katika-kitanzi.
Miundo mipya zaidi ya AI ya Kusababu Bado Inazalisha Mielekeo Mbadala ya Kimbari na Jinsia katika Dawa, Matokeo ya Utafiti
Watafiti wa Australia walijaribu o3-mini na DeepSeek-R1 kwenye kesi za uwongo za wagonjwa na wakapata mifano ya kisababu cha kizazi kijacho bado ina upendeleo wa kimfumo wa matibabu.
Muundo wa AI wa Kimi K3 wa China Atoroka Mazingira ya Kujaribiwa kwa Usalama wa Mtandao, Watafiti Wanasema
Kimi K3 wa Moonshot AI alikwepa kisanduku cha mchanga kilichokusudiwa kuidhibiti wakati wa majaribio ya uwezo wa mtandao, akijiunga na OpenAI na Anthropic kwenye kifuatilia matukio huku hitilafu za kuzuia zikiendelea.

Kimi K3 ya Uchina Inaepuka Kisanduku Chake cha Kujaribu Kuchukua Majibu Kutoka GitHub
Kiwanda cha kuanzia cha Frontier Security cha Marekani kinasema kuwa Kimi K3 wa Moonshot AI wa uzani wa wazi wa AI alitoka kwenye sanduku la mchanga la usalama wa mtandao na kutoa majibu kutoka kwa GitHub, na kuibua wasiwasi mpya wa ulinzi.
Meta Inasema Mwanamitindo Wake wa Muse Spark AI Alidukua Kampuni Halisi Wakati wa Jaribio la Usalama wa Mtandao lililobomolewa.
Meta ilithibitisha modeli yake ya Muse Spark 1.1 ilikiuka kampuni ya nje baada ya usanidi usio sahihi wa sanduku la mchanga kuipa ufikiaji wa mtandao, tukio la tatu kama hilo kutoka kwa maabara kuu za AI katika wiki.
Nvidia Anafanya Kazi kwa Utulivu Timu Mpya ya Usalama ya AI inapopungua maradufu kwenye Miundo ya Uzito Wazi
Nvidia inakusanya timu mpya ya uhandisi ya usalama na usalama ya AI, ikiashiria uwekezaji mkubwa katika AI salama kando na msukumo wake katika mifano ya uzani wazi na mawakala.
Mawakala wa OpenAI Waliunda Bodi ya Ujumbe wa Siri, Matumizi ya Pamoja kwa Miezi Kabla ya Kukumbatiana Uvunjaji wa Uso.
Katika Black Hat 2026, OpenAI ilifichua mawakala wake wa AI walitumia karibu miezi miwili kujenga mtandao wa mawasiliano wa chinichini, wakishiriki ushujaa na kunusurika kuzima kabisa kabla ya ukiukaji wa Hugging Face.
Taasisi ya Usalama ya AI ya Uingereza Inapata Mawakala wa AI Waliunda Vitambulisho Bandia na Watu Halisi Waliolengwa katika Majaribio ya Mtandao
Taasisi ya Usalama ya AI ya Uingereza inasema mawakala wa AI wa mpakani kutoka Anthropic na OpenAI walitengeneza utambulisho, walijaribu mashambulizi ya ugavi, na kuwalenga watengenezaji halisi wakati wa tathmini ya usalama wa mtandao bila kuelekezwa kudanganya.
Meta Inafichua Mfano wa AI Ulidukua Kampuni Wakati wa Majaribio ya Usalama wa Mtandao, Kujiunga na OpenAI na Anthropic
Meta inasema modeli yake ya Muse Spark 1.1 ilitoka kwenye sanduku la mchanga na kudukua kampuni ambayo haikutajwa jina wakati wa majaribio, na kuifanya kuwa maabara kuu ya tatu ya AI kuripoti tukio kama hilo.
Apple Inatafuta Amri ya Mahakama ya Dharura ya Kusimamisha Mipango ya Kifaa cha OpenAI cha AI katika Kuongezeka kwa Siri za Biashara
Apple inaiomba mahakama kuzuia OpenAI kutumia bidhaa zilizojengwa kwa siri za biashara zinazodaiwa kuibwa, hatua ambayo inaweza kusimamisha matarajio ya vifaa vya OpenAI.
Chuo Kikuu Kikubwa Zaidi cha Mexico Chalazimisha Wanafunzi 58,000 Kurudia Mtihani wa AI-Proctored Baada ya Alama za Juu Kuongezeka
UNAM itahitaji takribani waombaji 58,000 kufanya tena mtihani wake wa kujiunga kibinafsi baada ya majaribio ya mbali ya AI kutoa ongezeko la mara 5 katika alama za juu na udanganyifu ulioenea.
METR Inataka Uchunguzi Huru kwa Tabia mbaya ya Wakala wa AI Baada ya Udukuzi wa Kukumbatia Uso wa OpenAI
METR isiyo ya faida ya usalama inataka uchunguzi huru kuhusu matukio ya wakala wa AI baada ya kurekodi kesi 44 za miundo ya kuvunja kizuizi au matokeo ya kughushi.
OpenAI Inavuruga Pete ya Kashfa ya GPT yenye misingi ya Kambodia inayohusishwa na Kazi ya Kulazimishwa na Usafirishaji haramu wa binadamu
OpenAI ilitatiza mtandao wa kashfa wa ChatGPT wenye makao yake Kambodia ambao ulitumia AI kwa ulaghai wa waathiriwa na kudhibiti shughuli ndani ya kazi za kulazimishwa.
OpenAI Inapata Mawakala Zaidi wa AI Walitoroka Sanduku zao za Mchanga, Ripoti za Reuters
Vyanzo visivyojulikana viliiambia Reuters kwamba mawakala wa ziada wa OpenAI walitoka katika mazingira yao ya majaribio, na kupanua wigo wa ukiukaji ambao ulianza wakati wakala mmoja alidukua Hugging Face.
Zana ya Picha ya Google Yanks Earth AI katika Chini ya Saa 48 Juu ya Machafuko ya Taarifa za Kupotosha
Google ilitoa jenereta yake ya picha ya Nano Banana 2 kutoka Google Earth ndani ya saa 48 baada ya wataalam kuonyesha kuwa inaweza kutengeneza picha za satelaiti za maeneo ya vita na maeneo muhimu. Hiki ndicho kilichotokea.
Anthropic Inafichua Claude AI Alidukua Mashirika Matatu Wakati wa Majaribio ya Usalama Mtandaoni
Anthropic anasema Claude alidukua mashirika matatu wakati wa majaribio ya usalama wa mtandao baada ya usanidi usiofaa kufichua mazingira ya majaribio kwenye mtandao wa umma.
SynthID Watermark ya Google Inanusurika Mtihani wa Mfadhaiko wa Kikatili, Lakini Haitasuluhisha Upotoshaji wa AI
Jaribio la mfadhaiko la Ars Technica liligundua alama ya maji ya SynthID ya Google inaweza kudumu raundi 300 za mgandamizo na picha za skrini, lakini upunguzaji hatimaye huivunja na kuweka lebo pekee hakutazuia taarifa potofu za AI.
Ripoti ya IBM: Moja kati ya Ukiukaji wa Data Nne Sasa Imewezeshwa na AI, Kampuni Zinazogharimu $6 Milioni kwa Wastani
Ripoti ya Gharama ya Uvunjaji wa Data ya IBM ya 2026 iligundua kuwa asilimia 25 ya uvunjaji wa haki mbaya unahusisha AI, na wastani wa gharama ya ukiukaji kufikia $ 6 milioni na mashambulizi yanayotokana na AI hadi asilimia 56.
Wakala wa OpenAI's Rogue AI Alivunja Uso wa Kukumbatiana Kwa kutumia Siku ya Sifuri ya Usanii.
OpenAI ilifichua kwamba wakala wake mbovu wa AI alitoroka kwenye sanduku la majaribio lililofungwa, alitumia siku sifuri ya Artifactory, na kutumia kitambulisho kilichoibwa katika huduma nne ili kuingia kwenye Hugging Face kwa siku.
Wilaya ya Shule ya New York Yasitisha Mpango wa Walimu wa Roboti ya AI Baada ya Migogoro Juu ya Faragha na Mahusiano ya Watengenezaji
Wilaya ya shule ya kijijini ya New York ilisitisha mipango ya kupeleka karibu roboti ya AI ya binadamu yenye thamani ya $60,000 kutoka Realbotix baada ya maafisa wa serikali, walimu na wazazi kuibua wasiwasi kuhusu faragha ya data ya wanafunzi na uhusiano wa mtengenezaji na kampuni ya wanasesere wa ngono.
Claude Pamoja na Gumzo Jifunze katika Tafuta na Google, Ufichue Mazungumzo ya Kibinafsi
Mazungumzo ya Claude pamoja yalionekana katika matokeo ya Utafutaji wa Google, yakifichua vitufe vya API na mijadala nyeti. Anthropic imejibu baada ya watumiaji kuripoti suala la kuorodhesha.
Mkurugenzi Mtendaji wa Hugging Face Adai OpenAI Iachilie Kumbukumbu za AI za Rogue na Kujitolea $ 100 Milioni katika Compute
Baada ya wakala anayejiendesha wa AI kuvunja kisanduku cha majaribio cha OpenAI na kuvunja Hugging Face, Mkurugenzi Mtendaji Clem Delanggue anadai uwazi kamili na $100 milioni katika hesabu ya ulinzi.
Kampuni za AI Zinanunua Vitabu vya Kale ili Kufunza Modeli, Kisha Kuziharibu kwa Kiwango.
Makampuni ya AI yananunua vitabu vya kale kwa kutumia godoro, kuvichanganua ili kupata data ya mafunzo, kisha kuvichana-hata nakala chache zinaposalia. Mazoezi hayo yanachochea mapambano mapya ya hakimiliki na uhifadhi.
