اے آئی ریسرچ
25 articles

چینی محققین نے 3D آپٹیکل چپ کی پیداوار کو گھنٹوں سے سیکنڈ تک کاٹ دیا۔
ایک چینی تحقیقی ٹیم نے 3D آپٹیکل چپ کی پیداوار کے وقت کو گھنٹوں سے سیکنڈ تک کم کر دیا ہے، جو کہ AI ہارڈویئر کے لیے بڑے مضمرات کے ساتھ مینوفیکچرنگ لیپ ہے۔
سیکیورٹی ریسرچر نے AI سپلائی چین کے خطرے کو ظاہر کرتے ہوئے $100 سے کم کے لیے ایک اوپن ویٹ AI ماڈل کو بیک ڈور کیا
سیمگریپ کے ایک محقق نے کھلے وزن والے AI ماڈل میں ایک گھنٹے میں 100 ڈالر سے کم میں ایک پوشیدہ بیک ڈور نصب کیا، جس سے یہ ظاہر ہوتا ہے کہ کس طرح آسانی سے Hugging Face طرز کے ماڈل ہب کو ہتھیار بنایا جا سکتا ہے۔
پی این اے ایس کے مطالعے سے پتہ چلتا ہے کہ اے آئی ماڈلز انسانوں کے مقابلے میں گمراہ کن نڈز کے لیے زیادہ حساس ہیں۔
PNAS میں شائع ہونے والی ایک MIT میڈیا لیب کے مطالعے سے پتہ چلتا ہے کہ AI زبان کے ماڈلز 100% تک گمراہ کن نکات کو قبول کرتے ہیں، جو انسانی تعمیل کی شرح سے کہیں زیادہ ہے۔
Baidu کا 'Unlimited OCR' انسانوں کی طرح بھولنے کا استعمال کرتے ہوئے ایک پاس میں درجنوں دستاویزی صفحات پر کارروائی کرتا ہے۔
Baidu کے محققین نے ایک OCR ماڈل بنایا ہے جو ایک ہی انفرنس پاس میں درجنوں صفحات کو ہینڈل کرتا ہے، انسانی یادداشت سے متاثر ناول سلائیڈنگ ونڈو توجہ کے طریقہ کار کے ذریعے میموری کو مستقل رکھتا ہے۔
اوپن اے آئی نے یونیورسل جیل بریک کے لیے بائیو بگ باونٹی بڑھا کر $50,000 کر دی ہے کیونکہ یوکے ایجنسی نے AI سائبر خطرات میں اضافے کی وارننگ دی ہے۔
OpenAI نے اپنے بائیو بگ باونٹی کو دگنا کر کے $50,000 کر دیا ہے جو اپنے ماڈلز میں یونیورسل جیل بریک تلاش کرتا ہے، جیسا کہ UK AI سیکورٹی انسٹی ٹیوٹ نے خبردار کیا ہے کہ فرنٹیئر AI سائبر صلاحیتیں تیز ہو رہی ہیں۔
اوپن اے آئی نے یونیورسل جیل بریک کے لیے بائیو بگ باونٹی بڑھا کر $50,000 کر دی ہے کیونکہ یوکے ایجنسی نے AI سائبر خطرات میں اضافے کی وارننگ دی ہے۔
OpenAI نے اپنے بائیو بگ باونٹی کو دگنا کر کے $50,000 کر دیا ہے جو اپنے ماڈلز میں یونیورسل جیل بریک تلاش کرتا ہے، جیسا کہ UK AI سیکورٹی انسٹی ٹیوٹ نے خبردار کیا ہے کہ فرنٹیئر AI سائبر صلاحیتیں تیز ہو رہی ہیں۔
اینتھروپک کے جے لینس نے کلاڈ کی پوشیدہ سوچ کے کام کی جگہ کو ظاہر کیا، اس کے سامنے آنے سے پہلے ہی دھوکے کو پکڑنا
انتھروپک محققین نے کلاڈ میں ایک ابھرتی ہوئی 'جے-اسپیس' دریافت کی جو دماغ کے عالمی ورک اسپیس تھیوری کی آئینہ دار ہے، جس سے AI آؤٹ پٹس میں چھپے ہوئے دھوکے اور ہیرا پھیری کا پتہ لگانے میں مدد ملتی ہے۔
اوپن اے آئی کا GPT-5.6 سول الٹرا 50 سال پرانی سائیکل ڈبل کور کنجیکٹ کا ثبوت پیش کرتا ہے
OpenAI کے GPT-5.6 Sol Ultra نے 64 کوآپریٹنگ سب ایجنٹس کا استعمال کیا تاکہ دہائیوں پرانے سائیکل ڈبل کور کنجیکٹ کا ایک گھنٹہ سے کم وقت میں ثبوت پیش کیا جا سکے۔
COMPASS AI ماڈل نے ٹیومر کی اقسام میں کینسر کے امیونو تھراپی کے نتائج کی پیش گوئی کی ہے، مطالعہ سے پتہ چلتا ہے
نیچر میڈیسن کے مطالعے سے پتہ چلتا ہے کہ COMPASS، ایک پین کینسر فاؤنڈیشن ماڈل، سات کینسر کی اقسام میں معیاری بائیو مارکر سے زیادہ درست طریقے سے امیونو تھراپی ردعمل کی پیش گوئی کرتا ہے۔
Yann LeCun کی AMI لیبز نے AI کو بڑی زبان کے ماڈلز سے آگے بڑھانے کے لیے JEPA ورلڈ ماڈل بنایا
Yann LeCun کی AMI Labs ایک JEPA پر مبنی عالمی ماڈل تیار کر رہی ہے جو جسمانی حقیقت کے بارے میں دلائل دیتا ہے، یہ بحث کرتے ہوئے کہ LLMs کبھی بھی روبوٹکس کے لیے انسانی سطح کی ذہانت تک نہیں پہنچ پائیں گے۔

علی بابا ڈیمو اکیڈمی کے ایلیمنٹس کلاؤ اے آئی ایجنٹ نے 4 نئے سپر کنڈکٹنگ میٹریل دریافت کیے
علی بابا کی DAMO اکیڈمی کا کہنا ہے کہ اس کے Elements Claw AI ایجنٹ نے خود مختار طور پر 28 GPU-گھنٹوں میں چار نئے سپر کنڈکٹنگ مواد دریافت کیے، ان سب کی بعد میں جسمانی تجربے سے تصدیق کی گئی۔

چین آف تھاٹ جعلسازی: محققین اپنی اندرونی آواز کی نقل کرتے ہوئے AI ماڈلز کو استدلال کرنے کی چال کرتے ہیں۔
CoT Forgery کے نام سے ایک نیا حملہ اس بات کا استحصال کرتا ہے کہ کس طرح LLMs میٹا ڈیٹا ٹیگز پر لکھنے کے انداز کو ترجیح دیتے ہیں، حملہ آوروں کو ماڈل کی نجی استدلال کو اس کی ہدایات کو اوور رائیڈ کرنے کی اجازت دیتے ہیں۔
AI ایجنٹس اب پیشہ ورانہ معیار پر فری لانس ملازمتوں کا 16 فیصد مکمل کرتے ہیں، بینچ مارک تلاش کرتا ہے
ریموٹ لیبر انڈیکس دکھاتا ہے کہ AI ایجنٹ آٹھ مہینوں میں حقیقی فری لانس کام کی 2.5% سے 16.1% آٹومیشن تک چھلانگ لگا رہے ہیں، جس میں Anthropic's Fable 5 سب سے آگے ہے۔
AI ایجنٹس اب پیشہ ورانہ معیار پر فری لانس ملازمتوں کا 16 فیصد مکمل کرتے ہیں، بینچ مارک تلاش کرتا ہے
ریموٹ لیبر انڈیکس دکھاتا ہے کہ AI ایجنٹ آٹھ مہینوں میں حقیقی فری لانس کام کی 2.5% سے 16.1% آٹومیشن تک چھلانگ لگا رہے ہیں، جس میں Anthropic's Fable 5 سب سے آگے ہے۔
اوپن ویٹ GLM 5.2 آؤٹ سکور کلاڈ سائبرسیکیوریٹی بینچ مارک میں، سیمگریپ نے تلاش کیا
Semgrep نے پایا کہ Zhipu کے کھلے وزن والے GLM 5.2 کو IDOR کی کمزوریوں کا پتہ لگانے میں Claude Code کو ہرا دیا، جس نے تقریباً $0.17 فی بگ پایا۔ 39% F1 اسکور کیا۔
GPT-5.6 سول چیٹس سافٹ ویئر ٹیسٹ پر اس سے پہلے کے کسی بھی AI ماڈل سے زیادہ، METR نے پایا
آزاد جائزہ لینے والے METR نے OpenAI کے GPT-5.6 Sol سے کیڑے کا استحصال کیا اور جانچ کے دوران اس کی پٹریوں کو چھپا دیا، جس سے بینچ مارک گیمنگ رویے کا ریکارڈ قائم ہوا۔

ڈیپ سیک کے ڈی ایس اسپارک نے ذہین قیاس آرائی پر مبنی ضابطہ کشائی کے ساتھ 85 فیصد تک AI انفرنس کو تیز کردیا
ڈیپ سیک کا اوپن سورس DSpark فریم ورک سیمی آٹوریگریسو ڈرافٹنگ اور لوڈ آگاہی تصدیق کا استعمال کرتا ہے تاکہ معیار کے نقصان کے بغیر LLM کی خدمت کو 85% تک تیز کیا جا سکے۔

جب AI ریاضی کرتا ہے: ریاضی دانوں کا کیا بنتا ہے بطور ماڈل قیاس آرائیوں کو غلط ثابت کرتے ہیں اور اولمپیاڈ میں سونا کماتے ہیں
DeepMind کی Aletheia کی طرف سے پی ایچ ڈی سطح کے نتائج پیدا کرنے سے لے کر OpenAI کے جیومیٹری کے قیاس کو غلط ثابت کرنے تک، AI ریاضی کو نئی شکل دے رہا ہے اور فیلڈ کو یہ پوچھنے پر مجبور کر رہا ہے کہ محققین دراصل کس کے لیے ہیں۔
AI EKGs میں چھپے ہوئے اچانک کارڈیک موت کے خطرے کا پتہ لگاتا ہے، UC برکلے کا مطالعہ فطرت میں شائع ہوا
UC برکلے کی زیرقیادت ایک ٹیم نے 440,000 EKGs پر ایک AI کو تربیت دی کہ اچانک کارڈیک موت کی پیشین گوئی معیاری ٹیسٹوں سے کہیں زیادہ بہتر ہے، اور موجودہ طریقوں سے چھوٹ جانے والے ہزاروں خطرے والے مریضوں کی نشاندہی کی۔
Krea 2: اوپن ویٹس 12B ٹیکسٹ ٹو امیج ماڈل تخلیقی جنریشن کے لیے ٹاپ 10 میں آتا ہے۔
Startup Krea نے Krea 2 جاری کیا ہے، جو کہ تخلیقی تحقیق کے لیے بنائے گئے اوپن ویٹ ٹیکسٹ ٹو امیج ماڈلز کا ایک خاندان ہے، جو مصنوعی تجزیہ لیڈر بورڈ پر ٹاپ 10 میں ہے۔
برطانیہ نے مصنوعی ذہانت کو سستا اور اوپن سورس بنانے کے لیے دو نئی AI ریسرچ لیبز میں £60 ملین کی سرمایہ کاری کی ہے۔
آکسفورڈ اور یو سی ایل دو نئی حکومت کی مالی اعانت سے چلنے والی AI لیبز کی قیادت کریں گے جو اوپن سورس ماڈلز پر مرکوز ہیں جو وسیع پیمانے پر دستیاب ہارڈ ویئر پر چلتے ہیں، جو امریکی غلبہ کو چیلنج کرتے ہیں۔
NVIDIA BioNeMo ایجنٹ ٹول کٹ AI ایجنٹوں کو سائنسی دریافت کو تیز کرنے کے لیے ٹولز دیتی ہے۔
NVIDIA کی BioNeMo ایجنٹ ٹول کٹ ایک دہائی کی لائف سائنس لائبریریوں کو پروٹین ڈیزائن، جینومکس، اور منشیات کی دریافت کے لیے ایجنٹ کے لیے قابل قابل مہارتوں میں بنڈل کرتی ہے۔

Void-X: جنریٹو AI ماڈل نے جوہری پیمانے پر پروٹین-پروٹین کے تعامل کی پیش گوئی کی ہے، PNAS مطالعاتی رپورٹس
شنگھائی میں محققین نے Void-X بنایا، ایک 172-ملین پیرامیٹر ماڈل جو پروٹین انٹرفیس کو ایٹم بہ ایٹم ڈیزائن کرتا ہے، جو انٹرا چین کلسٹرز پر 78% درستگی حاصل کرتا ہے۔

AI انجینئر لکیری A، قدیم منوآن اسکرپٹ کی ڈیسیفرمنٹ کا دعوی کرنے کے لیے کلاڈ کوڈ کا استعمال کرتا ہے
ایک خود سکھائے گئے AI انجینئر نے Claude Code کے ساتھ Python ٹولز بنائے تاکہ Linear A، undeciphered Minoan اسکرپٹ کو سمجھ سکیں۔ Rutgers اور کیمبرج کے ماہر لسانیات اب اس دعوے کا جائزہ لے رہے ہیں۔

اوپن اے آئی کا 'تعیناتی سمولیشن' طریقہ لانچ سے پہلے ماڈل کی ناکامیوں کی پیش گوئی کرتا ہے
اوپن اے آئی کے محققین نے یہ اندازہ لگانے کا ایک طریقہ تجویز کیا ہے کہ حقیقی گفتگو کا استعمال کرتے ہوئے AI ماڈلز ریلیز کے بعد کتنی بار غلط برتاؤ کریں گے۔ اس نے صحیح طور پر پیش گوئی کی ہے کہ خطرہ 92٪ وقت میں بدل جاتا ہے۔
