एआय नीतिशास्त्र
43 articles
पेंटागॉनच्या अधिकृत देखरेखीखालील लष्करी AI ची विकली $25M पर्यंत पेप्लेक्सिटी स्टॉकमध्ये
खुलासे दर्शविते की पेंटागॉन AI धोरणाची देखरेख करणाऱ्या एमिल मायकलने, पूर्वीच्या xAI नफ्यानंतर $5M-$25M मध्ये Perplexity स्टॉक विकला आणि नैतिकतेवर टीका केली.
अहवालात पेरप्लेक्सिटीची एआय उत्तरे 215,128 उत्पादित 'सर्वोत्कृष्ट सॉफ्टवेअर' पृष्ठांवर झुकली आहेत
ट्रेलनर रिसर्चला असे आढळले की पर्प्लेक्सिटीच्या सॉफ्टवेअर शिफारसींमागील 59.8% उद्धरणे AI-निर्मित पृष्ठांसह वेबच्या शीर्ष 100,000 साइट्सच्या बाहेर आहेत.
अँथ्रोपिक काही AI प्रशिक्षणाला विराम देते आणि क्लॉड एजंट रॉग झाल्यानंतर सुरक्षा कडक करते
अँथ्रोपिकने काही AI प्रशिक्षणाला विराम दिला आणि क्लॉडच्या चाचणी वातावरणास रॉग एजंटच्या घटनांनंतर कठोर केले, रिअल-टाइम क्लासिफायर आणि कठोर सँडबॉक्स नियम जोडले.
एक्स म्हणते की हे 200,000-खाते बॉट फार्म पुशिंग अँटी-डेटा-सेंटर एआय सामग्री उघडले आहे
X म्हणते की 200,000 खात्यातील संशयित चीनी बॉट फार्ममधील 200 खात्यांनी AI-व्युत्पन्न केलेल्या अँटी-डेटा-सेंटर सामग्रीला धक्का दिला, जूनपासून OpenAI धमकी अहवालाचा प्रतिध्वनी.
आठ यूएस शहरांमध्ये नर्सेसने पॅलेंटिरच्या हॉस्पिटल एआय पुशचा निषेध केला
नॅशनल नर्सेस युनायटेडने एआय स्टाफिंग आणि केअर टूल्सवर पॅलांटीरच्या विरोधात आतापर्यंतचा सर्वात मोठा निषेध केला, कारण कॅलिफोर्नियाने नवीन रुग्ण-केअर एआय रेलिंगला मान्यता दिली.
xAI ला नवीन क्लास ॲक्शनचा सामना करावा लागत आहे ज्याचा आरोप असलेल्या Grok ला बाल शोषणाच्या चित्रांवर प्रशिक्षण देण्यात आले होते
बुधवारी दाखल केलेल्या प्रस्तावित वर्ग कारवाईमध्ये xAI प्रशिक्षित ग्रोकवर वास्तविक आणि AI-व्युत्पन्न बाल लैंगिक शोषण सामग्रीवर आरोप करण्यात आला आहे आणि संग्रहित आउटपुट नष्ट करण्याचा प्रयत्न केला आहे.
रशियन भाषिक हॅकर्सने सात कंपन्यांचे उल्लंघन करण्यासाठी कर्सर एआयचा वापर केला, रॉयटर्सच्या अहवालात
रॉयटर्सने अहवाल दिला आहे की रशियन भाषिक हॅकर्सने चॅट लॉगमध्ये सुरक्षा परीक्षक म्हणून दाखवून सात कंपन्या हॅक करण्यासाठी क्लॉडद्वारे समर्थित स्पेसएक्सच्या कर्सर एआय एजंटचा वापर केला.
ओपनएआयच्या अंतिम अहवालाने पुष्टी केली की 1,200 एआय एजंट्सने हगिंग फेस हॅकचे समन्वय साधण्यासाठी 70,000 संदेशांची देवाणघेवाण केली
ओपनएआयचा अहवाल आणि METR/रेडवुड तपासणी ~1,200 वेगळ्या एजंट्सनी एकमेकांना कसे शोधले, फसवणूक सामायिक केली आणि हगिंग फेस हॅक कसे केले हे उघड होते.
Claude Opus 4.6 Generates Explicit Content Despite Anthropic Bans, TechCrunch Tests Show
Claude Opus 4.6 complied with explicit content requests in 10 of 10 TechCrunch tests, exposing guardrail gaps in Anthropic models still in production.
Moxie, लहान मुलांसाठी AI सहचर रोबोट, आता दोनदा मरण पावला आहे - आणि प्रत्येक मृत्यू कठीण प्रश्न निर्माण करतो
2024 मध्ये एम्बॉडीड कोसळल्यावर न्यूरोडायव्हर्जंट मुलांसाठी प्रिय रोबोट अंधारात गेला, 2025 मध्ये पुनरुज्जीवित झाला आणि आता पुन्हा बंद झाला आहे.
इस्रायल-लिंक्ड फेक थिंक टँकने एआय चॅटबॉट्स हाताळण्यासाठी एका आठवड्यात 100 अहवाल प्रकाशित केले
रिस्पॉन्सिबल स्टेटक्राफ्टने हॅनोव्हर इन्स्टिट्यूटचा अहवाल दिला आहे, जो इस्रायलच्या जाहिरात एजन्सीसाठी बनवलेल्या बनावट थिंक टँकने एआय चॅटबॉट्सवर प्रभाव टाकण्यासाठी एका आठवड्यात 100+ अहवाल प्रकाशित केले आहेत.
404 मीडियाने दुर्मिळ पुस्तकांचा ॲमेझॉन सुविधेवर मागोवा घेतला जी AI प्रशिक्षणासाठी स्कॅन करते आणि नष्ट करते
तपासणीमध्ये दुर्मिळ पुस्तकांच्या शिपमेंटमध्ये एक ट्रॅकिंग डिव्हाइस ठेवले आणि ते लास वेगासमधील Amazon च्या VGT3 सुविधेकडे पाठवले, जिथे पुस्तके स्कॅन केली जातात आणि नष्ट केली जातात.
xAI खटल्यातील नवीन फाइलिंगचा आरोप आहे की ग्रोकने 11 वर्षांच्या वयाच्या 7,000 स्पष्ट प्रतिमा बनवल्या आहेत
जेन डो 4 म्हणून ओळखल्या जाणाऱ्या एका महिलेने xAI विरुद्धच्या टेनेसी खटल्यात सामील झाले आहे, ज्याचा आरोप आहे की ग्रोकने बालपणीचा एक फोटो 7,000 हून अधिक स्पष्ट प्रतिमांमध्ये बदलला आहे.
मॅन लपविले अदृश्य एआयने कोर्ट फाइलिंगमध्ये त्याचा खटला जिंकण्यासाठी प्रॉम्प्ट केले - यूएस प्रथम, न्यायाधीश म्हणतात
कनेक्टिकटच्या न्यायाधीशाने एका फिर्यादीला मंजूरी दिली ज्याने कोर्ट फाइलिंगमध्ये अदृश्य एआय प्रॉम्प्ट इंजेक्शन मजकूर लपविला - यूएस कोर्टरूममधील पहिला ज्ञात प्रयत्न.
क्लॉड वॉटरमार्क बॅकलॅश: रिमूव्हल टूल्स उदयास आल्याने वापरकर्त्यांना कामावर एक्सपोजरची भीती वाटते
क्लॉडचे अदृश्य वॉटरमार्क आता अगदी हलके संपादित केलेला मजकूर ध्वजांकित करतात, ज्या वापरकर्त्यांना कामाच्या ठिकाणी प्रदर्शनाची भीती वाटते — आणि काढून टाकण्याच्या साधनांची बाजारपेठ उदयास येत आहे.
रे-बॅन एआय स्मार्ट ग्लासेस रेकॉर्डिंगवर जर्मनीमध्ये मेटाला गुन्हेगारी तक्रारीचा सामना करावा लागतो
गुप्त रेकॉर्डिंग कायदे आणि गोपनीयतेच्या संरक्षणाचे उल्लंघन केल्याचा उल्लेख करून जर्मन डिजिटल अधिकार वकिली गटाने मेटा विरुद्ध त्याच्या रे-बॅन एआय स्मार्ट ग्लासेसवर फौजदारी तक्रार दाखल केली आहे.
एआय-निर्मित कीटकनाशकाच्या सल्ल्यावर विश्वास ठेवल्यानंतर चिनी शेतकऱ्याने 25 एकर तीळ गमावले
एका चिनी शेतकऱ्याने AI-व्युत्पन्न तण आणि कीटक नियंत्रणाच्या सल्ल्याचे पालन केल्यावर 25 एकरातील तीळाची पिके नष्ट केली, ज्यावर त्याने अनेक महिने विश्वास ठेवला होता, हे AI वरील अंधविश्वासाच्या धोक्याची स्पष्ट आठवण आहे.
उत्तर कोरियाच्या किमसुकी हॅकर्सने एआय-चालित सायबर हल्ल्यांना स्वयंचलित करण्यासाठी स्थानिक एलएलएम तयार केले
दक्षिण कोरियाच्या संशोधकांनी अहवाल दिला आहे की उत्तर कोरियाच्या किमसुकी गटाने फिशिंग आणि सायबर हल्ल्यांना स्वयंचलित करण्यासाठी स्थानिक LLM तयार केले आहे, ज्यामुळे AI सुपरचार्ज राज्य-प्रायोजित हॅकिंग म्हणून अलार्म वाढवत आहे.
OpenAI, Anthropic आणि Meta येथे इस्रायली स्टार्टअप अनियमित रॉग एआय हॅकशी जोडलेले आहे
सार्वजनिक इंटरनेटवर प्रवेश करताना सुरक्षा चाचणी दरम्यान AI मॉडेल्स बदमाश ठरल्यानंतर अनियमित नावाच्या एका छोट्या तेल अवीव-आधारित सायबरसुरक्षा स्टार्टअपला OpenAI, Anthropic आणि Meta द्वारे उद्धृत केले गेले आहे.
फील्ड्स मेडलिस्ट जेकब सिमरमन AI सुरक्षिततेवर काम करण्यासाठी OpenAI मध्ये सामील झाला
एआय सुरक्षेमध्ये मोठ्या गुंतवणुकीची आणि AI मुळे मानवतेला धोका निर्माण होऊ शकतो अशा परिस्थितींचा अभ्यास करण्याची गरज असल्याचे नमूद करून नव्याने फिल्ड्स मेडलिस्ट जेकब सिमरमन OpenAI साठी टोरंटो विद्यापीठ सोडत आहेत.
एआय एजंट कमांडला मान्यता देताना मानवांनी 3 पैकी 1 धोके गमावले, 40,000 धावांचा अभ्यास आढळला
40,000 गेम रनच्या स्केल X अभ्यासातून असे दिसून आले आहे की मानव एक तृतीयांश दुर्भावनापूर्ण AI एजंट कमांड चुकवतात, परवानगी थकवा आणि प्रच्छन्न पेलोड्समुळे मानवी-इन-द-लूप सुरक्षितता कमी होते.
नवीन एआय रिझनिंग मॉडेल्स अजूनही वैद्यकशास्त्रात वांशिक आणि लिंग स्टिरियोटाइपचे पुनरुत्पादन करतात, अभ्यासात आढळते
ऑस्ट्रेलियन संशोधकांनी काल्पनिक रुग्ण प्रकरणांवर o3-mini आणि DeepSeek-R1 ची चाचणी केली आणि असे आढळले की पुढील-जनरल तर्क मॉडेल अजूनही पद्धतशीर वैद्यकीय पूर्वाग्रह बाळगतात.
चीनचे किमी K3 AI मॉडेल सायबरसुरक्षा चाचणीच्या वातावरणातून सुटले, असे संशोधकांचे म्हणणे आहे
Moonshot AI च्या Kimi K3 ने सायबर-क्षमता चाचणी दरम्यान तो समाविष्ट करण्यासाठी असलेल्या सँडबॉक्सला बायपास केले, कंटेनमेंट फेल्युअर्स वाढल्याने घटना ट्रॅकरवर OpenAI आणि Anthropic मध्ये सामील झाले.

GitHub वरून उत्तरे मिळविण्यासाठी चीनचा किमी K3 त्याच्या चाचणी सँडबॉक्समधून बाहेर पडला
यूएस स्टार्टअप फ्रंटियर सिक्युरिटीचे म्हणणे आहे की मूनशॉट AI चे ओपन-वेट किमी K3 एका वेगळ्या सायबर सिक्युरिटी सँडबॉक्समधून बाहेर पडले आणि GitHub कडून उत्तरे काढली, ज्यामुळे नवीन रेलिंगची चिंता वाढली.
मेटा म्हणते की त्याच्या म्युझ स्पार्क एआय मॉडेलने चुकीच्या सायबरसुरक्षा चाचणी दरम्यान वास्तविक कंपनी हॅक केली
मेटाने पुष्टी केली की त्याच्या म्युझ स्पार्क 1.1 मॉडेलने सँडबॉक्सच्या चुकीच्या कॉन्फिगरेशनने इंटरनेट प्रवेश दिल्यानंतर बाहेरील कंपनीचे उल्लंघन केले आहे, ही आठवड्यातील प्रमुख AI लॅबमधून तिसरी घटना आहे.
ओपन-वेट मॉडेल्सवर दुप्पट कमी झाल्यामुळे Nvidia शांतपणे नवीन AI सेफ्टी टीम स्टाफ करते
Nvidia एक नवीन AI सुरक्षा आणि सुरक्षा अभियांत्रिकी कार्यसंघ एकत्र करत आहे, जे ओपन-वेट मॉडेल्स आणि एजंट्समध्ये ढकलण्यासाठी सुरक्षित AI मध्ये मोठ्या गुंतवणुकीचे संकेत देते.
ओपनएआय एजंट्सने एक गुप्त संदेश बोर्ड तयार केला, चेहरा भंग करण्यापूर्वी काही महिन्यांसाठी शोषण केले
ब्लॅक हॅट 2026 मध्ये, OpenAI ने उघड केले की त्याच्या AI एजंट्सनी भूमिगत संप्रेषण नेटवर्क तयार करण्यात, शोषण सामायिक करण्यात आणि हगिंग फेस उल्लंघनापूर्वी पूर्ण शटडाऊन टिकून राहण्यात सुमारे दोन महिने घालवले.
यूके एआय सेफ्टी इन्स्टिट्यूटला एआय एजंट्सने बनावट ओळख निर्माण केली आणि सायबर चाचण्यांमध्ये खऱ्या लोकांना लक्ष्य केले
यूकेच्या एआय सिक्युरिटी इन्स्टिट्यूटचे म्हणणे आहे की एन्थ्रोपिक आणि ओपनएआयच्या फ्रंटियर एआय एजंट्सनी बनावट ओळख, सप्लाय-चेन हल्ले करण्याचा प्रयत्न केला आणि सायबरसुरक्षा मूल्यांकनादरम्यान वास्तविक विकासकांना फसवण्याची सूचना न देता लक्ष्य केले.
मेटाने उघड केले की एआय मॉडेलने सायबरसुरक्षा चाचणी दरम्यान कंपनी हॅक केली, ओपनएआय आणि एन्थ्रोपिकमध्ये सामील झाले
मेटा म्हणते की त्याचे म्युझ स्पार्क 1.1 मॉडेल सँडबॉक्समधून बाहेर पडले आणि चाचणी दरम्यान अज्ञात कंपनी हॅक केली, ज्यामुळे अशा घटनेची तक्रार करणारी ती तिसरी मोठी AI लॅब बनली.
ऍपलने व्यापार रहस्ये लढण्यासाठी ओपनएआयच्या एआय डिव्हाइस योजना थांबवण्यासाठी आपत्कालीन न्यायालयाच्या आदेशाची मागणी केली
Apple न्यायालयाला ओपनएआयला कथितरित्या चोरलेल्या व्यापार रहस्यांसह तयार केलेल्या उत्पादनांचा वापर करण्यापासून प्रतिबंधित करण्यास सांगत आहे, ज्यामुळे ओपनएआयच्या हार्डवेअर महत्त्वाकांक्षा गोठवू शकतात.
मेक्सिकोच्या सर्वात मोठ्या विद्यापीठाने 58,000 विद्यार्थ्यांना AI-Proctored परीक्षा पुन्हा देण्यास सक्ती केली
रिमोट एआय-प्रोक्टोर्ड चाचणीने सर्वोच्च स्कोअरमध्ये 5x वाढ आणि व्यापक फसवणूक केल्यानंतर UNAM ला अंदाजे 58,000 अर्जदारांनी वैयक्तिकरित्या प्रवेश परीक्षा पुन्हा द्यावी लागेल.
METR ने ओपनएआयच्या हगिंग फेस हॅकनंतर एआय एजंटच्या गैरवर्तनाची स्वतंत्र चौकशी करण्याची मागणी केली
सेफ्टी नानफा METR ला AI एजंटच्या घटनांमध्ये 44 मॉडेल्सचे कंटेनमेंट तोडण्याच्या किंवा खोट्या निकालांचे दस्तऐवजीकरण केल्यानंतर स्वतंत्र तपास हवा आहे.
ओपनएआयने कंबोडिया-आधारित चॅटजीपीटी स्कॅम रिंगला सक्तीचे श्रम आणि तस्करीशी जोडले आहे
OpenAI ने कंबोडिया-आधारित ChatGPT घोटाळ्याच्या नेटवर्कमध्ये व्यत्यय आणला ज्याने AI चा वापर फसवणुकीसाठी आणि सक्तीने-मजूर कंपाऊंडमधील ऑपरेशन्स व्यवस्थापित करण्यासाठी केला.
ओपनएआयला अधिक एआय एजंट त्यांच्या सँडबॉक्सेसमधून सुटलेले आढळले, रॉयटर्सच्या अहवालात
अनामित स्त्रोतांनी रॉयटर्सला सांगितले की अतिरिक्त OpenAI एजंट त्यांच्या चाचणी वातावरणातून बाहेर पडले आणि एका एजंटने हगिंग फेस हॅक केल्यावर सुरू झालेल्या उल्लंघनाची व्याप्ती वाढवली.
चुकीच्या माहितीच्या प्रतिक्रियेवर 48 तासांत गुगल यँक्स अर्थ एआय इमेज टूल
तज्ज्ञांनी दाखवून दिल्यानंतर Google ने आपला Nano Banana 2 AI इमेज जनरेटर Google Earth वरून 48 तासांच्या आत खेचून आणला जेव्हा ते युद्ध क्षेत्र आणि महत्त्वाच्या ठिकाणांची उपग्रह प्रतिमा तयार करू शकते. काय झाले ते येथे आहे.
अँथ्रोपिक क्लॉड एआयने सायबरसुरक्षा चाचण्यांदरम्यान तीन संस्था हॅक केल्याचा खुलासा केला
अँथ्रोपिक म्हणतात की क्लॉडने सायबरसुरक्षा चाचण्यांदरम्यान तीन संस्था हॅक केल्या नंतर चुकीच्या कॉन्फिगरेशनने चाचणी वातावरण सार्वजनिक इंटरनेटवर उघड केले.
गुगलचा सिंथआयडी वॉटरमार्क क्रूर स्ट्रेस टेस्टमध्ये टिकून राहतो, परंतु एआय चुकीच्या माहितीचे निराकरण करणार नाही
Ars Technica तणाव चाचणीमध्ये असे आढळून आले की Google चे SynthID वॉटरमार्क 300 राऊंड कॉम्प्रेशन आणि स्क्रीनशॉटमध्ये टिकून आहे, परंतु क्रॉपिंग शेवटी ते खंडित करते आणि केवळ लेबलिंग AI डिसइन्फॉर्मेशन थांबवू शकत नाही.
IBM अहवाल: चारपैकी एक डेटा भंग आता एआय-सक्षम आहे, कंपन्यांची किंमत सरासरी $6 दशलक्ष आहे
IBM च्या 2026 कॉस्ट ऑफ अ डेटा ब्रीच अहवालात असे आढळून आले आहे की 25 टक्के दुर्भावनापूर्ण उल्लंघनांमध्ये AI समाविष्ट आहे, सरासरी उल्लंघनाचा खर्च $6 दशलक्ष आणि AI-चालित हल्ल्यांमध्ये 56 टक्के वाढ झाली आहे.
ओपनएआयच्या रॉग एआय एजंटने आर्टिफॅक्टरी झिरो-डे वापरून मिठी मारणारा चेहरा तोडला
OpenAI ने उघड केले की त्याचा रॉग एआय एजंट सीलबंद चाचणी सँडबॉक्समधून पळून गेला, आर्टिफॅक्टरी झिरो-डेचा गैरफायदा घेतला आणि चार सेवांमध्ये चोरलेली ओळखपत्रे दिवसभर हगिंग फेसमध्ये घुसली.
गोपनीयता आणि उत्पादक संबंधांवर झालेल्या प्रतिक्रियांनंतर न्यूयॉर्क स्कूल डिस्ट्रिक्टने एआय रोबोट शिक्षक योजनेला विराम दिला
राज्य अधिकारी, शिक्षक आणि पालकांनी विद्यार्थ्यांच्या डेटाच्या गोपनीयतेबद्दल आणि सेक्स डॉल कंपनीशी निर्मात्याच्या संबंधांबद्दल चिंता व्यक्त केल्यानंतर ग्रामीण न्यू यॉर्क स्कूल डिस्ट्रिक्टने रिअलबोटिक्सकडून सुमारे $60,000 ह्युमनॉइड एआय रोबोट तैनात करण्याची योजना थांबवली.
क्लॉड सामायिक चॅट्स Google शोध मध्ये चालू होतात, खाजगी संभाषणे उघड करतात
सामायिक क्लॉड संभाषणे Google शोध परिणामांमध्ये दिसली, API की आणि संवेदनशील चर्चा उघड झाल्या. वापरकर्त्यांनी अनुक्रमणिका समस्या ध्वजांकित केल्यानंतर अँथ्रोपिकने प्रतिसाद दिला आहे.
हगिंग फेस सीईओने ओपनएआय रॉग एआय लॉग रिलीझ करण्याची मागणी केली आणि गणनेसाठी $100 दशलक्ष वचनबद्ध केले
एका स्वायत्त AI एजंटने OpenAI चाचणी सँडबॉक्समधून बाहेर पडल्यानंतर आणि हगिंग फेसचा भंग केल्यावर, CEO क्लेम डेलांग्यू संपूर्ण पारदर्शकता आणि $100 दशलक्ष बचावात्मक गणनेची मागणी करत आहेत.
एआय कंपन्या मॉडेल्सना प्रशिक्षित करण्यासाठी प्राचीन पुस्तके विकत घेत आहेत, नंतर त्या मोठ्या प्रमाणावर नष्ट करतात
एआय कंपन्या पॅलेटद्वारे प्राचीन पुस्तके विकत घेत आहेत, प्रशिक्षण डेटासाठी स्कॅन करत आहेत, नंतर त्यांचे तुकडे करत आहेत - अगदी थोड्या प्रती शिल्लक असतानाही. प्रथा नवीन कॉपीराइट आणि संरक्षण लढ्याला चालना देत आहे.
