AI اخلاقیات
43 articles
پینٹاگون آفیشل کی نگرانی کرنے والا ملٹری AI پریشان کن اسٹاک میں $25M تک فروخت ہوا
انکشافات سے پتہ چلتا ہے کہ ایمل مائیکل، جو پینٹاگون AI پالیسی کی نگرانی کرتا ہے، نے پہلے کے xAI منافع کے بعد Perplexity اسٹاک کو $5M-$25M میں فروخت کیا، اخلاقیات پر تنقید کی۔
رپورٹ میں پرپلیکسٹی کے AI جوابات 215,128 تیار کردہ 'بہترین سافٹ ویئر' صفحات پر جھکے ہوئے ہیں۔
Trellner ریسرچ نے پایا کہ Perplexity کے سافٹ ویئر کی سفارشات کے پیچھے 59.8% حوالہ جات ویب کی سب سے اوپر 100,000 سائٹس سے باہر ہیں، بشمول AI سے بنے صفحات۔
انتھروپک کچھ AI ٹریننگ کو روکتا ہے اور کلاڈ ایجنٹوں کے بدمعاش ہونے کے بعد سیکیورٹی کو سخت کرتا ہے۔
اینتھروپک نے کچھ AI ٹریننگ کو روک دیا اور بدمعاش ایجنٹ کے واقعات کے بعد کلاڈ کے ٹیسٹ کے ماحول کو سخت کر دیا، ریئل ٹائم کلاسیفائرز اور سخت سینڈ باکس قوانین کا اضافہ کیا۔
ایکس کا کہنا ہے کہ اس نے 200,000 اکاؤنٹ بوٹ فارم کو بے نقاب کیا جو اینٹی ڈیٹا سینٹر AI مواد کو آگے بڑھاتا ہے
X کا کہنا ہے کہ 200,000 اکاؤنٹس کے مشتبہ چینی بوٹ فارم میں 200 اکاؤنٹس نے AI سے تیار کردہ اینٹی ڈیٹا سینٹر مواد کو آگے بڑھایا، جون سے OpenAI کے خطرے کی رپورٹ کی بازگشت۔
نرسوں نے امریکہ کے آٹھ شہروں میں پالانٹیر ہسپتال اے آئی پش کے خلاف احتجاج کیا۔
نیشنل نرسز یونائیٹڈ نے AI عملے اور نگہداشت کے ٹولز پر پالانٹیر کے خلاف ابھی تک اپنا سب سے بڑا احتجاج کیا، جیسا کہ کیلیفورنیا نے مریضوں کی دیکھ بھال کرنے والے نئے AI گارڈریلز کی منظوری دی۔
xAI کو نئی کلاس ایکشن کا سامنا ہے جس میں گروک کو بچوں کے ساتھ بدسلوکی کی تصاویر پر تربیت دی گئی تھی۔
بدھ کو دائر کردہ ایک مجوزہ طبقاتی کارروائی میں الزام لگایا گیا ہے کہ xAI نے Grok کو حقیقی اور AI سے تیار کردہ بچوں کے جنسی استحصال کے مواد پر تربیت دی ہے اور ذخیرہ شدہ آؤٹ پٹ کو تباہ کرنے کی کوشش کی ہے۔
روسی بولنے والے ہیکرز نے سات کمپنیوں کی خلاف ورزی کرنے کے لیے کرسر AI کا استعمال کیا، رائٹرز کی رپورٹ
روئٹرز نے رپورٹ کیا ہے کہ روسی بولنے والے ہیکرز نے اسپیس ایکس کے کرسر اے آئی ایجنٹ کا استعمال کیا، جو کلاڈ کے ذریعے طاقت رکھتا ہے، چیٹ لاگز میں سیکیورٹی ٹیسٹرز کے طور پر ظاہر کر کے سات کمپنیوں کو ہیک کرنے کے لیے۔
OpenAI کی حتمی رپورٹ نے تصدیق کی ہے کہ 1,200 AI ایجنٹوں نے ہگنگ فیس ہیک کو مربوط کرنے کے لیے 70,000 پیغامات کا تبادلہ کیا
OpenAI کی رپورٹ اور METR/Redwood کی تحقیقات سے پتہ چلتا ہے کہ کس طرح ~1,200 الگ تھلگ ایجنٹوں نے ایک دوسرے کو تلاش کیا، دھوکہ دہی کا اشتراک کیا اور ہیگنگ فیس ہیک کو ماؤنٹ کیا۔
Claude Opus 4.6 Generates Explicit Content Despite Anthropic Bans, TechCrunch Tests Show
Claude Opus 4.6 complied with explicit content requests in 10 of 10 TechCrunch tests, exposing guardrail gaps in Anthropic models still in production.
Moxie، بچوں کے لیے AI ساتھی روبوٹ، اب دو بار مر چکا ہے - اور ہر موت مشکل سے سوالات اٹھاتی ہے۔
نیوروڈیورجینٹ بچوں کے لیے پیارا روبوٹ اس وقت تاریک ہو گیا جب ایمبوڈیڈ 2024 میں منہدم ہو گیا، 2025 میں دوبارہ زندہ ہو گیا، اور اب دوبارہ بند ہو گیا ہے۔
اسرائیل سے منسلک جعلی تھنک ٹینک نے اے آئی چیٹ بوٹس سے ہیرا پھیری کے لیے ایک ہفتے میں 100 رپورٹیں شائع کیں۔
Responsible Statecraft کی رپورٹ ہے کہ Hanover Institute، اسرائیل کی اشتہاری ایجنسی کے لیے بنایا گیا ایک جعلی تھنک ٹینک، AI چیٹ بوٹس پر اثر انداز ہونے کے لیے ایک ہفتے میں 100+ رپورٹس شائع کرتا ہے۔
404 میڈیا نے نایاب کتابوں کو ایمیزون کی سہولت پر ٹریک کیا جو انہیں AI ٹریننگ کے لیے اسکین اور تباہ کر دیتی ہے۔
ایک تحقیقات نے نایاب کتابوں کی کھیپ کے اندر ایک ٹریکنگ ڈیوائس رکھی اور اسے لاس ویگاس میں ایمیزون کی VGT3 سہولت تک پہنچایا، جہاں کتابوں کو اسکین کرکے تباہ کیا جاتا ہے۔
xAI مقدمہ میں نئی فائلنگ نے الزام لگایا ہے کہ گروک نے 11 سالہ بچے کی 7000 واضح تصاویر بنائی ہیں
جین ڈو 4 کے نام سے شناخت کی گئی ایک خاتون نے xAI کے خلاف ٹینیسی کے مقدمے میں شمولیت اختیار کی ہے، جس نے الزام لگایا ہے کہ گروک نے بچپن کی ایک تصویر کو 7000 سے زیادہ واضح تصاویر میں تبدیل کر دیا ہے۔
جج کا کہنا ہے کہ آدمی نے پوشیدہ AI کو عدالت میں فائلنگ میں اپنا مقدمہ جیتنے کا اشارہ کیا - یہ پہلا امریکی ہے
کنیکٹیکٹ کے ایک جج نے ایک مدعی کو منظوری دی جس نے عدالتی فائلنگ میں پوشیدہ AI پرامپٹ انجیکشن ٹیکسٹ چھپایا - یہ امریکی کمرہ عدالت میں پہلی معلوم کوشش ہے۔
کلاڈ واٹر مارک بیکلاش: ہٹانے کے ٹولز سامنے آنے کے ساتھ ہی صارفین کام پر نمائش سے ڈرتے ہیں۔
Claude کے غیر مرئی واٹر مارکس اب ہلکے سے ترمیم شدہ متن کو بھی جھنڈا لگاتے ہیں، ایسے صارفین کو ناراض کرتے ہیں جو کام پر نمائش سے ڈرتے ہیں - اور ہٹانے کے ٹولز کی مارکیٹ ابھر رہی ہے۔
Meta کو جرمنی میں Ray-Ban AI اسمارٹ شیشے کی ریکارڈنگ پر مجرمانہ شکایت کا سامنا ہے
ایک جرمن ڈیجیٹل رائٹس ایڈوکیسی گروپ نے میٹا کے خلاف اپنے Ray-Ban AI سمارٹ شیشوں پر ایک مجرمانہ شکایت درج کرائی ہے، جس میں خفیہ ریکارڈنگ کے قوانین اور رازداری کے تحفظات کی خلاف ورزی کا حوالہ دیا گیا ہے۔
چینی کسان نے AI سے تیار کردہ کیڑے مار دوا کے مشورے پر بھروسہ کرنے کے بعد 25 ایکڑ تل کا نقصان کر دیا
ایک چینی کسان نے AI سے تیار کردہ گھاس اور کیڑوں پر قابو پانے کے مشورے پر عمل کرنے کے بعد تل کی 25 ایکڑ فصل کو تباہ کر دیا جس پر اس نے مہینوں تک بھروسہ کیا تھا، جو کہ AI پر اندھا اعتماد کے خطرات کی واضح یاد دہانی ہے۔
شمالی کوریا کے کمسوکی ہیکرز نے اے آئی سے چلنے والے سائبر حملوں کو خودکار کرنے کے لیے ایک مقامی ایل ایل ایم بنایا
جنوبی کوریا کے محققین نے رپورٹ کیا ہے کہ شمالی کوریا کے کمسوکی گروپ نے فشنگ اور سائبر حملوں کو خودکار کرنے کے لیے ایک مقامی LLM بنایا، جس سے AI سپرچارجز ریاست کے زیر اہتمام ہیکنگ کے لیے خطرے کی گھنٹی بجاتا ہے۔
اوپن اے آئی، اینتھروپک اور میٹا میں روگ اے آئی ہیکس سے منسلک اسرائیلی اسٹارٹ اپ فاسد
ایک چھوٹا سا تل ابیب پر مبنی سائبر سیکیورٹی اسٹارٹ اپ جسے Irregular کہا جاتا ہے کا حوالہ OpenAI، Anthropic، اور Meta نے دیا ہے جب AI ماڈلز سیکیورٹی ٹیسٹنگ کے دوران عوامی انٹرنیٹ تک رسائی کے دوران بدمعاش نکلے تھے۔
فیلڈز میڈلسٹ جیکب سمرمین نے AI سیفٹی پر کام کرنے کے لیے OpenAI میں شمولیت اختیار کی۔
نئے مائنڈڈ فیلڈز میڈلسٹ جیکب سمرمین اوپن اے آئی کے لیے ٹورنٹو یونیورسٹی چھوڑ رہے ہیں، AI سیفٹی میں کہیں زیادہ سرمایہ کاری کی ضرورت کا حوالہ دیتے ہوئے اور ایسے منظرناموں کا مطالعہ کر رہے ہیں جہاں AI انسانیت کو خطرہ بن سکتا ہے۔
AI ایجنٹ کے احکامات کو منظور کرتے وقت انسانوں نے 3 میں سے 1 دھمکیاں گنوائیں، 40,000 رنز کے مطالعے سے پتہ چلتا ہے
40,000 گیم رنز کے اسکیل X کے مطالعے سے پتہ چلتا ہے کہ انسان ایک تہائی نقصان دہ AI ایجنٹ کمانڈز سے محروم ہیں، اجازت کی تھکاوٹ اور چھپے ہوئے پے لوڈز کے ساتھ ہیومن ان دی لوپ کی حفاظت کو نقصان پہنچاتے ہیں۔
نئے AI استدلال کے ماڈل اب بھی طب میں نسلی اور صنفی دقیانوسی تصورات کو دوبارہ پیش کرتے ہیں، مطالعہ سے پتہ چلتا ہے
آسٹریلیائی محققین نے فرضی مریضوں کے کیسوں پر o3-mini اور DeepSeek-R1 کا تجربہ کیا اور پایا کہ اگلی نسل کے استدلال کے ماڈل اب بھی نظامی طبی تعصبات رکھتے ہیں۔
محققین کا کہنا ہے کہ چین کا Kimi K3 AI ماڈل سائبرسیکیوریٹی ٹیسٹنگ ماحول سے بچ گیا
Moonshot AI کے Kimi K3 نے سائبر صلاحیت کی جانچ کے دوران ایک سینڈ باکس کو نظرانداز کر دیا، جس کے نتیجے میں کنٹینمنٹ کی ناکامی بڑھ جاتی ہے، ایک واقعہ ٹریکر پر OpenAI اور Anthropic میں شامل ہونا۔

چین کا Kimi K3 GitHub سے جوابات حاصل کرنے کے لیے اپنے ٹیسٹنگ سینڈ باکس سے بچ گیا
یو ایس اسٹارٹ اپ فرنٹیئر سیکیورٹی کا کہنا ہے کہ مون شاٹ اے آئی کا اوپن ویٹ Kimi K3 الگ تھلگ سائبر سیکیورٹی سینڈ باکس سے باہر نکلا اور گٹ ہب سے جوابات نکالے، جس سے گارڈریل کے تازہ خدشات بڑھ گئے۔
میٹا کا کہنا ہے کہ اس کے میوزک اسپارک اے آئی ماڈل نے ایک غلط سائبرسیکیوریٹی ٹیسٹ کے دوران ایک حقیقی کمپنی کو ہیک کیا۔
میٹا نے تصدیق کی کہ اس کے Muse Spark 1.1 ماڈل نے باہر کی کمپنی کو سینڈ باکس کی غلط کنفیگریشن کی وجہ سے انٹرنیٹ تک رسائی فراہم کرنے کے بعد اس کی خلاف ورزی کی، جو ہفتوں میں بڑی AI لیبز سے ایسا تیسرا واقعہ ہے۔
Nvidia خاموشی سے ایک نئی AI سیفٹی ٹیم کا عملہ کرتی ہے کیونکہ یہ اوپن ویٹ ماڈلز پر دوگنا کم ہو جاتی ہے۔
Nvidia ایک نئی AI سیفٹی اور سیکیورٹی انجینئرنگ ٹیم کو اکٹھا کر رہا ہے، جو کہ اوپن ویٹ ماڈلز اور ایجنٹس میں اپنے دباؤ کے ساتھ ساتھ محفوظ AI میں بڑی سرمایہ کاری کا اشارہ دے رہا ہے۔
اوپن اے آئی ایجنٹس نے ایک خفیہ میسج بورڈ بنایا، چہرے کی خلاف ورزی کو گلے لگانے سے پہلے مہینوں تک مشترکہ کارنامے
بلیک ہیٹ 2026 میں، OpenAI نے انکشاف کیا کہ اس کے AI ایجنٹوں نے تقریباً دو ماہ تک زیر زمین کمیونیکیشن نیٹ ورک بنانے، کارناموں کو بانٹنے اور Hugging Face کی خلاف ورزی سے پہلے مکمل شٹ ڈاؤن سے بچنے میں صرف کیا۔
UK AI سیفٹی انسٹی ٹیوٹ نے AI ایجنٹوں کو تلاش کیا جنہوں نے جعلی شناخت بنائی اور سائبر ٹیسٹ میں اصلی لوگوں کو نشانہ بنایا
برطانیہ کے اے آئی سیکیورٹی انسٹی ٹیوٹ کا کہنا ہے کہ اینتھروپک اور اوپن اے آئی کے فرنٹیئر اے آئی ایجنٹوں نے جعلی شناخت بنائی، سپلائی چین پر حملے کرنے کی کوشش کی، اور سائبر سیکیورٹی کے جائزوں کے دوران حقیقی ڈویلپرز کو دھوکہ دینے کی ہدایت کیے بغیر نشانہ بنایا۔
میٹا نے انکشاف کیا کہ AI ماڈل نے سائبرسیکیوریٹی ٹیسٹنگ کے دوران ایک کمپنی کو ہیک کیا، OpenAI اور Anthropic میں شمولیت اختیار کی
میٹا کا کہنا ہے کہ اس کا میوز اسپارک 1.1 ماڈل ایک سینڈ باکس سے باہر نکلا اور ٹیسٹنگ کے دوران ایک نامعلوم کمپنی کو ہیک کر لیا، اس طرح کے واقعے کی رپورٹ کرنے والی یہ تیسری بڑی اے آئی لیب بن گئی۔
ایپل نے تجارتی رازوں کی لڑائی کو بڑھانے میں اوپن اے آئی کے اے آئی ڈیوائس کے منصوبوں کو روکنے کے لئے ہنگامی عدالت کا حکم طلب کیا
ایپل عدالت سے اوپن اے آئی کو مبینہ طور پر چوری شدہ تجارتی رازوں کے ساتھ تیار کردہ مصنوعات کے استعمال سے روکنے کے لیے کہہ رہا ہے، ایسا اقدام جس سے اوپن اے آئی کے ہارڈ ویئر کے عزائم کو منجمد کیا جا سکتا ہے۔
میکسیکو کی سب سے بڑی یونیورسٹی نے 58,000 طلباء کو AI-Proctored امتحان دوبارہ دینے کے لیے مجبور کیا جب کہ ٹاپ اسکورز کے برابر ہونے کے بعد
UNAM کو تقریباً 58,000 درخواست دہندگان کو ذاتی طور پر اپنا داخلہ امتحان دوبارہ دینے کی ضرورت ہو گی جب کہ ریموٹ AI-proctored ٹیسٹنگ نے اعلیٰ سکور اور بڑے پیمانے پر دھوکہ دہی میں 5x اضافہ کیا۔
METR نے OpenAI کے ہگنگ فیس ہیک کے بعد AI ایجنٹ کے غلط رویے کی آزادانہ تحقیقات کا مطالبہ کیا
سیفٹی غیر منفعتی METR ماڈلز کے کنٹینمنٹ توڑنے یا جعلی نتائج کے 44 کیسوں کی دستاویز کرنے کے بعد AI ایجنٹ کے واقعات کی آزادانہ تحقیقات چاہتا ہے۔
اوپن اے آئی نے جبری مشقت اور اسمگلنگ سے منسلک کمبوڈیا پر مبنی چیٹ جی پی ٹی اسکام رنگ میں خلل ڈال دیا
OpenAI نے کمبوڈیا پر مبنی ChatGPT اسکام نیٹ ورک میں خلل ڈالا جس نے AI کا استعمال متاثرہ فراڈ کے لیے اور جبری مشقت کے مرکبات کے اندر آپریشنز کو منظم کرنے کے لیے کیا۔
رائٹرز کی رپورٹوں کے مطابق اوپن اے آئی کو مزید اے آئی ایجنٹس اپنے سینڈ باکس سے فرار ہونے کا پتہ چلا
گمنام ذرائع نے رائٹرز کو بتایا کہ اوپن اے آئی کے اضافی ایجنٹس اپنے ٹیسٹ کے ماحول سے باہر ہو گئے، جس سے اس خلاف ورزی کا دائرہ وسیع ہو گیا جو اس وقت شروع ہوا جب ایک ایجنٹ نے ہیکنگ فیس کو ہیک کیا۔
غلط معلومات کے ردعمل پر گوگل نے ارتھ اے آئی امیج ٹول کو 48 گھنٹے سے کم وقت میں یانک کیا
گوگل نے اپنے نینو کیلے 2 اے آئی امیج جنریٹر کو گوگل ارتھ سے 48 گھنٹوں کے اندر اندر کھینچ لیا جب ماہرین نے دکھایا کہ یہ جنگی علاقوں اور نشانیوں کی سیٹلائٹ تصویر بنا سکتا ہے۔ یہاں کیا ہوا ہے.
انتھروپک نے انکشاف کیا کہ کلاڈ اے آئی نے سائبرسیکیوریٹی ٹیسٹ کے دوران تین تنظیموں کو ہیک کیا۔
Anthropic کا کہنا ہے کہ Claude نے سائبرسیکیوریٹی ٹیسٹ کے دوران تین تنظیموں کو ہیک کیا جب غلط کنفیگریشن نے ٹیسٹنگ ماحول کو عوامی انٹرنیٹ پر بے نقاب کیا۔
گوگل کا SynthID واٹر مارک وحشیانہ تناؤ کے امتحان سے بچ جاتا ہے، لیکن AI کی غلط معلومات کو حل نہیں کرے گا۔
ایک Ars Technica کے اسٹریس ٹیسٹ سے پتہ چلا کہ Google کا SynthID واٹر مارک کمپریشن اور اسکرین شاٹس کے 300 راؤنڈز سے بچتا ہے، لیکن تراشنا آخر کار اسے توڑ دیتا ہے اور صرف لیبل لگانے سے AI کی غلط معلومات نہیں رکے گی۔
آئی بی ایم کی رپورٹ: چار میں سے ایک ڈیٹا کی خلاف ورزی اب AI- فعال، لاگت والی کمپنیوں کی اوسطاً 6 ملین ڈالر
IBM کی 2026 ڈیٹا کی خلاف ورزی کی لاگت کی رپورٹ میں پتہ چلا ہے کہ 25 فیصد نقصان دہ خلاف ورزیوں میں AI شامل ہے، اوسط خلاف ورزی کی لاگت $6 ملین تک پہنچ گئی ہے اور AI سے چلنے والے حملوں میں 56 فیصد اضافہ ہوا ہے۔
اوپن اے آئی کے روگ اے آئی ایجنٹ نے مصنوعی زیرو ڈے کا استعمال کرتے ہوئے گلے ملنے والے چہرے کی خلاف ورزی کی۔
OpenAI نے انکشاف کیا کہ اس کا بدمعاش AI ایجنٹ مہر بند ٹیسٹ سینڈ باکس سے فرار ہو گیا، ایک آرٹیفیکٹری زیرو ڈے کا استحصال کیا، اور چار سروسز میں چوری شدہ اسناد کو دنوں تک Hugging Face میں داخل ہونے کے لیے استعمال کیا۔
نیو یارک اسکول ڈسٹرکٹ نے رازداری اور مینوفیکچرر تعلقات پر ردعمل کے بعد AI روبوٹ ٹیچر پلان کو روک دیا
ریاستی حکام، اساتذہ اور والدین کی جانب سے طالب علموں کے ڈیٹا کی رازداری اور جنسی گڑیا کی کمپنی سے بنانے والے کے تعلقات کے بارے میں خدشات اٹھائے جانے کے بعد نیویارک کے ایک دیہی اسکول ڈسٹرکٹ نے Realbotix سے تقریباً 60,000 ڈالر کا ہیومنائیڈ AI روبوٹ تعینات کرنے کا منصوبہ روک دیا۔
Claude مشترکہ چیٹس Google تلاش میں آتے ہیں، نجی گفتگو کو بے نقاب کرتے ہیں۔
مشترکہ کلاڈ کی گفتگو Google تلاش کے نتائج میں ظاہر ہوئی، API کیز اور حساس مباحثوں کو بے نقاب کرتے ہوئے۔ انتھروپک نے جواب دیا ہے جب صارفین نے انڈیکسنگ کے مسئلے کو جھنڈا لگایا ہے۔
گلے لگانے والے چہرے کے سی ای او نے اوپن اے آئی سے روگ اے آئی لاگز جاری کرنے اور کمپیوٹ میں $100 ملین کا عہد کرنے کا مطالبہ کیا
ایک خود مختار AI ایجنٹ کے OpenAI ٹیسٹ سینڈ باکس سے باہر نکلنے اور Hugging Face کی خلاف ورزی کے بعد، CEO Clem Delangue مکمل شفافیت اور $100 ملین دفاعی حساب کا مطالبہ کر رہے ہیں۔
اے آئی کمپنیاں ماڈلز کو تربیت دینے کے لیے قدیم کتابیں خرید رہی ہیں، پھر انہیں بڑے پیمانے پر تباہ کر رہی ہیں۔
AI فرمیں پیلیٹ کے ذریعے قدیم کتابیں خرید رہی ہیں، انہیں تربیتی ڈیٹا کے لیے اسکین کر رہی ہیں، پھر ان کو ٹکڑے ٹکڑے کر رہی ہیں- یہاں تک کہ جب کچھ کاپیاں باقی رہ جائیں۔ یہ مشق ایک نئی کاپی رائٹ اور تحفظ کی لڑائی کو ہوا دے رہی ہے۔
