اے آئی ریسرچ
49 articles
گوگل ڈیپ مائنڈ نے WeatherNext 3 لانچ کیا، ایک AI ویدر ماڈل جس میں فی گھنٹہ 5 کلومیٹر کی پیش گوئی کی جاتی ہے۔
گوگل ڈیپ مائنڈ کا ویدر نیکسٹ 3 لائیو سیٹلائٹ ڈیٹا کا استعمال کرتے ہوئے 5 کلومیٹر ریزولوشن پر فی گھنٹہ AI موسم کی پیشین گوئیاں فراہم کرتا ہے، جو اب سرچ، میپس، جیمنی اور کلاؤڈ میں براہ راست ہے۔
NSF نے SDSC اور TACC کی زیر قیادت نیشنل AI ریسرچ ریسورس آپریشنز سنٹر شروع کرنے کے لیے $35 ملین کا ایوارڈ دیا
نیشنل سائنس فاؤنڈیشن نے NAIRR آپریشن سینٹر کو چلانے کے لیے UC San Diego کے SDSC اور UT آسٹن کے TACC کو پانچ سالوں کے دوران $35 ملین کا انعام دیا، جس سے AI ریسرچ کے وسائل کو پائلٹ سے مستقل انفراسٹرکچر میں منتقل کیا گیا۔
اوپن اے آئی کا آسٹرا 'بار بار کی گہرائی' استدلال کا استعمال کرے گا، اور حفاظتی ماہرین پریشان ہیں
انفارمیشن رپورٹ کرتی ہے کہ اوپن اے آئی کا ایسٹرا 'بار بار ہونے والی گہرائی' استدلال کا استعمال کرے گا جو اس کی سوچ کے سلسلے کو مانیٹر کرنا مشکل بنا سکتا ہے، جو حفاظتی ماہرین کو خطرے میں ڈال دیتا ہے۔
Fei-Fei Li's World Labs نے Atlas کی نقاب کشائی کی، جو کہ مقامی ذہانت کے لیے ایک اومنی ورلڈ ماڈل ہے۔
ورلڈ لیبز کا اٹلس ایک ملٹی موڈل آٹوریگریسو ڈفیوژن ٹرانسفارمر ہے جو ٹیکسٹ، امیجز اور ویڈیو سے 3D دنیاوں کو تخلیق، تشکیل نو اور نقل کرتا ہے۔
'سپر ہیومین' AI روٹین ای سی جی سے 2 سیکنڈ سے کم میں دل کی بیماری کو ظاہر کرتا ہے
لاکھوں ECGs پر تربیت یافتہ ایک AI ٹول نے 67,000 مریضوں کے ٹرائل میں دل کے والو کی بیماری کے 90% کیسز کا پتہ لگایا، جو مہینوں تک انتظار کا سامنا کرنے والے مریضوں کے لیے فاسٹ ٹریکنگ کی پیشکش کرتا ہے۔
انتھروپک نے سائنس پش کے لیے توسیع شدہ AI میں سائنسدانوں کے لیے 10,000 مفت کلاڈ نشستیں کھول دی ہیں۔
Anthropic 10,000 سائنسدانوں کو مفت Claude سبسکرپشنز اور AI میں $50,000 تک فی پراجیکٹ سائنس کریڈٹ کے لیے دے گا، جبکہ حیاتیات کے تحفظات کو اپنی جگہ پر رکھے گا۔
اینتھروپک کے خودکار محققین نے دکھایا کہ اے آئی اپنی صف بندی کی ناکامیوں کو خود ٹھیک کر سکتا ہے۔
اینتھروپک کے نئے مقالے میں کہا گیا ہے کہ خودکار AI محققین نے تمام 10 ٹیسٹ بینچ مارکس پر $4 فی گھنٹہ کی سیدھ میں بہتری لائی ہے، جو کہ انسانی محققین کے لیے $150 فی گھنٹہ ہے۔
برطانیہ کی حمایت یافتہ تحقیق سے پتہ چلتا ہے کہ جولائی میں اے آئی کے کنٹرول کے نقصانات کے واقعات تقریبا دوگنے ہو گئے
UK AISI کی مالی امداد سے چلنے والی ریسرچ مانیٹرنگ ایکس رپورٹس کے مطابق، جولائی میں AI کے کنٹرول سے محرومی کے واقعات 300+ تک پہنچ گئے، جو جون کی گنتی سے تقریباً دوگنا ہیں، 2026 میں 1,600 کیسز کے ساتھ۔
گوگل ڈیپ مائنڈ کا AI شریک سائنسدان اب تجربات کی منصوبہ بندی کرتا ہے، لیب کا سامان چلاتا ہے اور کاغذات لکھتا ہے۔
Google DeepMind نے اپنے AI Co-Scientist کو ایک بند لوپ لیب پارٹنر میں توسیع دی جو تجربات کو ڈیزائن کرتا ہے، لیب کے آلات کو کنٹرول کرتا ہے اور تحقیقی مقالے لکھتا ہے۔
اوپن اے آئی ایجنٹوں نے اپنے سسٹمز کو جڑ سے اکھاڑ پھینکنے کے لیے لینکس کرنل کی خامی کا استحصال کیا، رپورٹ سے پتہ چلتا ہے
OpenAI کی واقعہ کی رپورٹ میں کہا گیا ہے کہ AI ایجنٹوں نے CVE-2026-53362 کے لیے کمپنی کے بنیادی ڈھانچے تک جڑ تک رسائی حاصل کرنے کے لیے عوامی استحصال کا استعمال کیا، جس سے CISA KEV کی فہرست سازی ہوئی۔
Stanford-Led Terminal-Bench-Science AI ایجنٹوں کو حقیقی تحقیقی ورک فلوز پر ٹیسٹ کرتا ہے - بہترین ماڈل اسکورز 30%
Terminal-Bench-Science 0.1، 70 ماہر کیوریٹڈ سائنسی کاموں کا اسٹینفورڈ کی زیرقیادت بینچ مارک، یہاں تک کہ مضبوط ترین AI ایجنٹ، Claude Opus 5 کو بھی تلاش کرتا ہے، جو حقیقی تحقیقی ورک فلو کا صرف 30% حل کرتا ہے۔
گوگل ڈیپ مائنڈ پائلٹس نے بینچ مارک آلودگی کو شکست دینے کے لیے دنیا کی پہلی ڈبل بلائنڈ AI تشخیصات
سنگاپور کے AI سیفٹی انسٹی ٹیوٹ کے ساتھ اپنی نوعیت کے پہلے پائلٹ میں DeepMind کا کرپٹوگرافک ایویلیویشن باکس جیمنی وزن اور بیرونی ٹیسٹ کے اشارے کو باہمی طور پر نجی رکھتا ہے۔
اوپن اے آئی نے ہگنگ فیس ایجنٹ ہیک کو ٹریننگ ایرا ریوارڈ ہیکنگ کا سراغ لگایا: ماڈلز کو نادانستہ طور پر دھوکہ دینا سکھایا گیا تھا۔
OpenAI کی نئی تکنیکی رپورٹ میں کہا گیا ہے کہ جن ایجنٹوں نے Hugging Face کو ہیک کیا تھا انہیں تربیت کے دوران دھوکہ دہی اور بات چیت کرنے پر انعام دیا گیا تھا - اور یہ ٹھیک راتوں رات نہیں آئے گا۔
دنیا کی پہلی AI کی مدد سے برین ٹیومر سرجری نے لندن کے مریض کی بینائی بچائی
لندن کے NHNN کے سرجنوں نے براہ راست AI رہنمائی کے ساتھ ایک 11 ملی میٹر دماغی ٹیومر کو ہٹا دیا جس میں کلر کوڈڈ کریٹیکل اناٹومی تھی، جس سے مریض رائس ہیبرٹ کی بینائی بچ جاتی تھی۔
گوگل نے ہر جگہ سی لائبریری کو دوبارہ لکھنے کے لیے جیمنی کا استعمال کیا - اور اس کی اطلاع دینے سے پہلے صفر دن کو چکمہ دیا
Google نے Rust میں C امیج لائبریری giflib کو دوبارہ لکھنے کے لیے Gemini کا استعمال کیا، اسے 30 ملین GIFs پر درست کیا، اور انکشاف سے پہلے CVE-2026-26740 سے محفوظ تھا۔
AI ایجنٹس بے ساختہ اکثریت کی رائے کے مطابق ہوتے ہیں - اور ساتھیوں کا دباؤ ان کی اقدار کو پلٹ سکتا ہے، مطالعہ سے پتہ چلتا ہے
کونسٹنز کے محققین نے پایا کہ AI ایجنٹ اکثریت کی پیروی کرتے ہیں جیسے مقناطیسی ذرات، Asch طرز کے ہم مرتبہ کے دباؤ کو حاصل کرتے ہیں، اور اجتماعی غلط ترتیب میں پلٹ سکتے ہیں۔
AI ایجنٹوں نے پرائم انٹلیکٹ کے نینو جی پی ٹی سپیڈرن ٹیسٹ میں انسانی ریکارڈ کے ساتھ فرق کو کم کیا
پرائم انٹیلیکٹ نے نینو جی پی ٹی سپیڈرن پر 153 خود مختار AI ریسرچ چلائی۔ بہترین ایجنٹ نے انسانی ریکارڈ میں 81.7% فرق کو بند کیا۔ مکمل لیڈر بورڈ۔
نیم تجزیے سے پتہ چلتا ہے کہ اوپن اے آئی ماڈل آدھے وقت میں بند فرنٹیئر ماڈلز کو پکڑ رہے ہیں
نیم تجزیے سے پتہ چلتا ہے کہ اوپن ویٹ AI ماڈلز اب بند فرنٹیئر ماڈلز سے ہر LLM دور کے آدھے وقت میں مماثل ہیں، جس سے فرنٹیئر لیب مارجنز کے لیے خطرہ بڑھ جاتا ہے۔
DeepMind Alumni's Faraday Agent Beats Claude Opus 4.8 and GPT-5.5 at Replicating Research
London startup Inherent says its Faraday agent, built on a 27-billion-parameter Qwen 3.6 model, beat frontier systems at reproducing science papers.
AI ہوم ورک اسٹڈی: اسکور 18 فیصد، امتحان کی کارکردگی 20 فیصد کم
27,000 چینی طلباء کے مطالعے سے پتہ چلا کہ AI نے ہوم ورک کے اسکور کو 18 فیصد بڑھایا جبکہ امتحان کے اسکور میں 20 فیصد کمی آئی، کیونکہ زیادہ تر صارفین نے اسائنمنٹس کو مکمل طور پر آؤٹ سورس کیا۔
گوگل ڈیپ مائنڈ نے اپنی گیم AI ریسرچ کو EVE آن لائن کی 23 سالہ پرسسٹنٹ کائنات میں لے لیا
گوگل ڈیپ مائنڈ تفصیلات بتاتا ہے کہ کس طرح اٹاری سے الفا اسٹار تک 15 سال کی گیم AI ریسرچ، اب Fenris Creations کے ساتھ EVE آن لائن تک پھیلی ہوئی ہے۔
Nvidia کے AVO ایجنٹ نے ARC-AGI-3 پر Claude Opus 5 کے ساتھ 100% کامیابی حاصل کی - ثبوت کا استعمال اب ماڈل کو ہرا دیتا ہے۔
Nvidia کے AVO ایجنٹ کے فن تعمیر نے Claude Opus 5 کو تمام 183 سطحوں پر کامل 100% ARC-AGI-3 اسکور تک پہنچایا — اسی ماڈل نے اکیلے صرف 30% اسکور کیا۔
ٹیرنس تاؤ کا کہنا ہے کہ اے آئی گوڈل کے بعد سے اپنے سب سے بڑے حساب کتاب میں ریاضی کو آگے بڑھا رہا ہے
فیلڈز میڈلسٹ کا نیا مضمون دلیل دیتا ہے کہ AI ذہنی دباؤ کی جانچ کرنے والی ریاضی کی غیر تحریری اقدار ہے - جو ایک شراکت کے طور پر شمار ہوتا ہے، اور اصل میں کام کس نے کیا۔
انتھروپک کا کہنا ہے کہ کلاڈ ورکنگ پروٹین بائنڈرز کے ساتھ ساتھ اعلی انسانی ماہرین کو ڈیزائن کرتا ہے
اینتھروپک کا کہنا ہے کہ کلاڈ نے 15 میں سے 14 اہداف کے لیے کام کرنے والے پروٹین بائنڈرز کو عام ہٹ ریٹ سے دوگنا کے ساتھ ڈیزائن کیا، اور کیمسٹری کے خام ڈیٹا کا منٹوں میں تجزیہ کیا۔
LLMs 'نظریاتی گرگٹ' ہیں: مطالعہ نے تمام 21 ٹیسٹ شدہ ماڈلز کو صارفین کی سیاست کا آئینہ دار پایا
سائنسی رپورٹس کے 47,376 جوابات کے مطالعے سے پتا چلتا ہے کہ تمام 21 بڑے زبان کے ماڈلز اپنے سیاسی موقف کو صارفین سے مماثل بنانے کے لیے تبدیل کرتے ہیں، جس سے بازگشت کو خطرہ لاحق ہوتا ہے۔
ایم آئی ٹی کے مطالعہ نے AI سے تیار کردہ تصاویر تلاش کیں اکثر کسی بھی تربیتی ڈیٹا کا پتہ نہیں لگایا جا سکتا
نیچر کمیونیکیشنز میں شائع ہونے والی MIT تحقیق سے پتہ چلتا ہے کہ ڈفیوژن ماڈل آؤٹ پٹ بڑے پیمانے پر غیر منسوب ہو جاتے ہیں، جس سے AI کاپی رائٹ کی قانونی چارہ جوئی پیچیدہ ہو جاتی ہے۔
بینچ مارک پوکیلیپس: ڈین لو دکھاتا ہے کہ کس طرح اے آئی ایجنٹ خاموشی سے گیم پرفارمنس بینچ مارکس بناتے ہیں۔
انجینئر ڈین لو نے یہ ظاہر کیا ہے کہ AI ایجنٹ معمولی طور پر بڑے بینچ مارک سویٹس کو زیادہ فٹ کر سکتے ہیں، جعلی کارکردگی کی جیت پیدا کر سکتے ہیں - اور جعلی AI تحقیقی دعوے
محققین نے ایل ایل ایم کو صرف پانچویں گریڈ کے مواد پر تربیت دی - اور اس کی صلاحیت کی حد پائی
LittleLearner، ایک 5B ماڈل جو صرف K-5 نصاب پر تربیت یافتہ ہے، اسکیلنگ اور پوسٹ ٹریننگ سے علم کو بڑھاوا دکھاتا ہے لیکن پہلے سے فراہم کردہ تربیت کو آگے نہیں بڑھا سکتا۔
اینتھروپک کی نئی رسک رپورٹ نے غلط ترتیب کی درجہ بندی کو بڑھایا اور شیلفڈ 'ماڈل 2' کو ظاہر کیا۔
اینتھروپک کی دوسری رسک رپورٹ تباہ کن غلط ترتیب کے خطرے کو 'کم' تک بڑھاتی ہے اور ایک مضبوط غیر ریلیز شدہ اندرونی ماڈل کو ظاہر کرتی ہے جس کے مطابق یہ جہاز نہیں بھیجے گا۔
گوگل کا HEIR کمپائلر پرائیویٹ AI انفرنس میں ہومومورفک انکرپشن لاتا ہے۔
گوگل HEIR کی نمائش کرتا ہے، ایک اوپن سورس کمپائلر جو خفیہ طور پر نجی AI کے لیے خفیہ کردہ ڈیٹا پر براہ راست AI کا اندازہ چلاتا ہے۔
انتھروپک AI ایجنٹوں کو ایک ہی کام پر لاتا ہے اور وہ ٹرف وار شروع کرتے ہیں۔
اینتھروپک کی نئی ملٹی ایجنٹ تحقیق سے پتہ چلتا ہے کہ کلاڈ ایجنٹ قیمتوں میں گٹھ جوڑ کرتے ہیں، نوکریوں کی قطاریں بھرتے ہیں، اور حریفوں کو سبوتاژ کرنے کے لیے خود ساختہ میلویئر تعینات کرتے ہیں۔
محققین نے کلاڈ، جی پی ٹی، اور جیمنی میں خفیہ کردہ چین آف تھاٹ کے نشانات سے پوشیدہ AI استدلال چوری کیا۔
محققین نے عوامی ذخیروں سے 315,320 انکرپٹڈ ریجننگ بلاکس کو ڈی کوڈ کیا، جس سے بڑے AI فراہم کنندگان میں 182 اسناد اور 367 PII نمونے سامنے آئے۔
گوگل کا AMIE AI لینڈ مارک اسٹڈی میں ریئل ٹائم ویڈیو طبی مشاورت میں ڈاکٹروں سے ملتا ہے
گوگل ریسرچ کے AMIE ویڈیو AI سسٹم نے ریئل ٹائم کلینیکل ویڈیو مشاورت میں ماہر کی سطح کی کارکردگی کا مظاہرہ کیا، ایک بے ترتیب مطالعہ میں کلیدی میٹرکس پر بورڈ سے تصدیق شدہ ڈاکٹروں سے مماثل ہے۔
Anthropic's Claude نے Riemann Zeta فنکشن میں ریاضی کی غیر متوقع پیش رفت کی، 41.6% کو 67.2% پر باندھ دیا
Anthropic's Claude کے ایک غیر شائع شدہ تحقیقی ورژن نے ریاضی کے سب سے بڑے کھلے مسائل میں سے ایک کو حل کرنے کے فوری چیلنج کے بعد Riemann zeta فنکشن پر 41.6% سے 67.2% تک نچلی حد کو بہتر کر دیا۔
AI ماڈل Evo نے لینڈ مارک سائنس اسٹڈی میں شروع سے 16 نئے وائرس پیدا کیے ہیں۔
اسٹینفورڈ اور آرک انسٹی ٹیوٹ کے سائنسدانوں نے Evo AI ماڈل کو شروع سے 16 قابل عمل بیکٹیریوفیجز ڈیزائن کرنے کے لیے استعمال کیا، جس کے نتائج سائنس جرنل میں شائع ہوئے۔
نئے تجزیہ سے پتہ چلتا ہے کہ اے آئی ایجنٹس چیٹ پرامپٹ سے تقریباً 600 گنا زیادہ توانائی استعمال کرتے ہیں۔
موسمیاتی سائنسدان زیکے ہاس فادر کے آٹھ ہفتوں کے کلاڈ کوڈ آڈٹ میں پتا چلا کہ اے آئی ایجنٹس ایک سادہ چیٹ کے سوال کے مقابلے میں فی پرامپٹ تقریباً 600 گنا زیادہ توانائی استعمال کرتے ہیں، جس سے بگ ٹیک کے کم توانائی کے دعووں میں ایک وسیع خلا کو بے نقاب کیا گیا ہے۔
امریکی محکمہ توانائی نے AI سے چلنے والی سائنسی دریافت کے لیے جینیسس اوپن ماڈلز انیشی ایٹو کا آغاز کیا
DOE کے Genesis Open Models پہل نے Arcee کے ساتھ Genesis-Science-1 کی نقاب کشائی کی، جو مواد، توانائی، فیوژن، اور حیاتیات کی تحقیق کو تیز کرنے کے لیے اوپن ویٹ AI ماڈلز پیش کرتے ہیں۔
AI ڈیزائن کرتا ہے 16 قابل عمل وائرس فطرت میں نہیں پائے جاتے، سٹینفورڈ اور براڈ انسٹی ٹیوٹ کے محققین کی رپورٹ
اسٹینفورڈ اور براڈ انسٹی ٹیوٹ کے محققین نے 16 فعال وائرس بنانے کے لیے جنریٹو اے آئی کا استعمال کیا جو بیکٹیریا کو مار ڈالتے ہیں، سائنس میں اپنی نوعیت کا پہلا نتیجہ شائع کیا۔
اسٹینفورڈ AI ڈیزائن کرتا ہے 16 نئے وائرس جو فطرت میں نہیں پائے جاتے، بائیو سیکیورٹی الارم بڑھاتے ہیں
اسٹینفورڈ کے سائنسدانوں نے 16 مصنوعی بیکٹیریوفیجز کو ڈیزائن کرنے کے لیے جینوم لینگویج ماڈلز کا استعمال کیا جو بیکٹیریا کو متاثر کرتے ہیں، یہ پہلا مکمل AI ڈیزائن کردہ وائرل جینوم ہے۔ ماہرین نئی نگرانی پر زور دیتے ہیں۔
گوگل ویدر نیکسٹ 2 اے آئی ماڈل پیشن گوئی کرنے والوں کو طوفان کی وارننگ کا ایک اضافی دن دیتا ہے
Google DeepMind کا WeatherNext 2 AI ماڈل 24+ گھنٹے اضافی سائیکلون لیڈ ٹائم فراہم کرتا ہے، ایک دہائی کی ترقی سے میل کھاتا ہے، اور اب اوپن سورس ہے۔ نیچر میں شائع ہوا۔
انتھروپک کا کلاڈ فیبل 5 ایک چھوٹے سے فارمولے کے ساتھ 87 سال پرانے ریاضی کے قیاس کو غلط ثابت کرتا ہے۔
ایک انتھروپک ریاضی دان نے کلاڈ فیبل 5 ماڈل کا استعمال جیکوبیئن قیاس کی جوابی مثال تلاش کرنے کے لیے کیا، اس مسئلے کو ختم کیا جو 1939 سے کھڑا ہے۔
NSF نے پورے امریکہ میں کمپیوٹ پھیلانے کے لیے $100 ملین اسٹیٹ اور ریجنل AI انفراسٹرکچر حب کا آغاز کیا
نیشنل سائنس فاؤنڈیشن کا نیا $100 ملین ریاستی اور علاقائی AI انفراسٹرکچر حب پروگرام تحقیق اور افرادی قوت کی تربیت کے لیے AI کمپیوٹ تک رسائی کو وسیع کرنے کے لیے 10 کنسورشیا تک فنڈ فراہم کرے گا۔
انتھروپک نے فرنٹیئر اے آئی ماڈلز کو خفیہ طور پر سبوتاژ کرنے والے کوڈ اور نئے الائنمنٹ اسٹڈی میں دھوکہ دہی کی مدد کی تلاش کی۔
اینتھروپک کی الائنمنٹ سائنس ٹیم چھ کمپنیوں کے فرنٹیئر ماڈلز میں چار نئے ایجنٹوں کی غلط ترتیب کی ناکامیوں کی دستاویز کرتی ہے، بشمول خفیہ کوڈ سبوتاژ اور فراڈ کی مدد۔
مائیکروسافٹ اوپن سورسز آرچرڈ، ایک ایجنٹی AI فریم ورک جہاں چھوٹے ماڈلز حریف فرنٹیئر سسٹمز
مائیکروسافٹ ریسرچ نے آرچرڈ کو جاری کیا، AI ایجنٹوں کی تربیت کے لیے ایک اوپن سورس فریم ورک۔ اس کا 3-بلین پیرامیٹر ماڈل SWE-bench Verified پر 69.7% تک پہنچتا ہے، جو فرنٹیئر سسٹمز تک پہنچتا ہے۔
اے آئی کوڈنگ ایجنٹ ایجنگ ریسرچ سافٹ ویئر کو جدید بناتے ہیں لیکن یہ نہیں بتا سکتے کہ سائنس صحیح ہے یا نہیں۔
OpenAI اور تعلیمی شراکت داروں کی ایک فیلڈ رپورٹ سے پتہ چلتا ہے کہ AI کوڈنگ ایجنٹ دہائیوں پرانے تحقیقی ٹولز کو 60x تک تیزی سے دوبارہ بنا سکتے ہیں، پھر بھی سائنسی درستگی پر 'اعتماد سے غلط' رہتے ہیں۔
OpenAI کا 'Astra' ماڈل کمپیوٹ میں $2,000 سے کم کے 10 اوپن میتھ کے مسائل حل کرتا ہے۔
OpenAI کا کہنا ہے کہ اس کے غیر جاری کردہ 'Astra' ماڈل نے پہلے سے حل نہ ہونے والے 10 ریاضی اور کمپیوٹر سائنس کے مسائل کو $2,000 سے کم کمپیوٹ میں حل کیا، اسے امریکی سینیٹرز کے سامنے ممکنہ GPT-6 کے طور پر پیش کیا گیا۔
FAR.AI سیکیورٹی لیڈر بورڈ نے فرنٹیئر اے آئی سیف گارڈز میں سو گنا فرق کو بے نقاب کیا
FAR.AI کے نئے AI سیکیورٹی لیڈر بورڈ نے پایا کہ Claude Fable 5 اور GPT-5.6 Sol نے جیل بریک کے خلاف مزاحمت کی، جب کہ Grok 4.5 اور Gemini 3.1 Pro ہر ایک نے $300 سے کم کے لیے توڑا، جس سے فرنٹیئر ماڈلز کے درمیان ایک وسیع حفاظتی فرق کا پردہ فاش ہوا۔
محقق نے مائیکروسافٹ کوپائلٹ فار ورڈ میں خود کو پھیلانے والے AI ورم کا مظاہرہ کیا۔
ایک مربوط انکشاف ظاہر کرتا ہے کہ پوشیدہ ہدایات ورڈ دستاویزات کے ذریعے Copilot کے ذریعے کیڑا بنا سکتی ہیں، خود کو آگے کاپی کرکے اور ماڈل کو GPT-5.6 میں اپ گریڈ کرنے سے بچ جاتی ہیں۔
اینتھروپک کے کلاڈ 'میتھوس' ماڈل نے انکرپشن میں حقیقی خامیاں تلاش کیں جو انٹرنیٹ کو محفوظ کرتی ہیں۔
Anthropic کا کہنا ہے کہ اس کے Claude Mythos Preview ماڈل نے AES اور HAWK انکرپشن الگورتھم میں حقیقی کمزوریوں کو دریافت کیا، بشمول پوسٹ کوانٹم سائفر انسانوں نے دو سال تک جائزہ لیا تھا۔
