اے آئی ریسرچ

49 articles

گوگل ڈیپ مائنڈ نے WeatherNext 3 لانچ کیا، ایک AI ویدر ماڈل جس میں فی گھنٹہ 5 کلومیٹر کی پیش گوئی کی جاتی ہے۔
اے آئی ریسرچ

گوگل ڈیپ مائنڈ نے WeatherNext 3 لانچ کیا، ایک AI ویدر ماڈل جس میں فی گھنٹہ 5 کلومیٹر کی پیش گوئی کی جاتی ہے۔

گوگل ڈیپ مائنڈ کا ویدر نیکسٹ 3 لائیو سیٹلائٹ ڈیٹا کا استعمال کرتے ہوئے 5 کلومیٹر ریزولوشن پر فی گھنٹہ AI موسم کی پیشین گوئیاں فراہم کرتا ہے، جو اب سرچ، میپس، جیمنی اور کلاؤڈ میں براہ راست ہے۔

4 ستمبر، 20266 min read
NSF نے SDSC اور TACC کی زیر قیادت نیشنل AI ریسرچ ریسورس آپریشنز سنٹر شروع کرنے کے لیے $35 ملین کا ایوارڈ دیا
اے آئی ریسرچ

NSF نے SDSC اور TACC کی زیر قیادت نیشنل AI ریسرچ ریسورس آپریشنز سنٹر شروع کرنے کے لیے $35 ملین کا ایوارڈ دیا

نیشنل سائنس فاؤنڈیشن نے NAIRR آپریشن سینٹر کو چلانے کے لیے UC San Diego کے SDSC اور UT آسٹن کے TACC کو پانچ سالوں کے دوران $35 ملین کا انعام دیا، جس سے AI ریسرچ کے وسائل کو پائلٹ سے مستقل انفراسٹرکچر میں منتقل کیا گیا۔

3 ستمبر، 20266 min read
اوپن اے آئی کا آسٹرا 'بار بار کی گہرائی' استدلال کا استعمال کرے گا، اور حفاظتی ماہرین پریشان ہیں
اے آئی ریسرچ

اوپن اے آئی کا آسٹرا 'بار بار کی گہرائی' استدلال کا استعمال کرے گا، اور حفاظتی ماہرین پریشان ہیں

انفارمیشن رپورٹ کرتی ہے کہ اوپن اے آئی کا ایسٹرا 'بار بار ہونے والی گہرائی' استدلال کا استعمال کرے گا جو اس کی سوچ کے سلسلے کو مانیٹر کرنا مشکل بنا سکتا ہے، جو حفاظتی ماہرین کو خطرے میں ڈال دیتا ہے۔

3 ستمبر، 20267 min read
Fei-Fei Li's World Labs نے Atlas کی نقاب کشائی کی، جو کہ مقامی ذہانت کے لیے ایک اومنی ورلڈ ماڈل ہے۔
اے آئی ریسرچ

Fei-Fei Li's World Labs نے Atlas کی نقاب کشائی کی، جو کہ مقامی ذہانت کے لیے ایک اومنی ورلڈ ماڈل ہے۔

ورلڈ لیبز کا اٹلس ایک ملٹی موڈل آٹوریگریسو ڈفیوژن ٹرانسفارمر ہے جو ٹیکسٹ، امیجز اور ویڈیو سے 3D دنیاوں کو تخلیق، تشکیل نو اور نقل کرتا ہے۔

1 ستمبر، 20267 min read
'سپر ہیومین' AI روٹین ای سی جی سے 2 سیکنڈ سے کم میں دل کی بیماری کو ظاہر کرتا ہے
اے آئی ریسرچ

'سپر ہیومین' AI روٹین ای سی جی سے 2 سیکنڈ سے کم میں دل کی بیماری کو ظاہر کرتا ہے

لاکھوں ECGs پر تربیت یافتہ ایک AI ٹول نے 67,000 مریضوں کے ٹرائل میں دل کے والو کی بیماری کے 90% کیسز کا پتہ لگایا، جو مہینوں تک انتظار کا سامنا کرنے والے مریضوں کے لیے فاسٹ ٹریکنگ کی پیشکش کرتا ہے۔

1 ستمبر، 20267 min read
انتھروپک نے سائنس پش کے لیے توسیع شدہ AI میں سائنسدانوں کے لیے 10,000 مفت کلاڈ نشستیں کھول دی ہیں۔
اے آئی ریسرچ

انتھروپک نے سائنس پش کے لیے توسیع شدہ AI میں سائنسدانوں کے لیے 10,000 مفت کلاڈ نشستیں کھول دی ہیں۔

Anthropic 10,000 سائنسدانوں کو مفت Claude سبسکرپشنز اور AI میں $50,000 تک فی پراجیکٹ سائنس کریڈٹ کے لیے دے گا، جبکہ حیاتیات کے تحفظات کو اپنی جگہ پر رکھے گا۔

31 اگست، 20266 min read
اینتھروپک کے خودکار محققین نے دکھایا کہ اے آئی اپنی صف بندی کی ناکامیوں کو خود ٹھیک کر سکتا ہے۔
اے آئی ریسرچ

اینتھروپک کے خودکار محققین نے دکھایا کہ اے آئی اپنی صف بندی کی ناکامیوں کو خود ٹھیک کر سکتا ہے۔

اینتھروپک کے نئے مقالے میں کہا گیا ہے کہ خودکار AI محققین نے تمام 10 ٹیسٹ بینچ مارکس پر $4 فی گھنٹہ کی سیدھ میں بہتری لائی ہے، جو کہ انسانی محققین کے لیے $150 فی گھنٹہ ہے۔

29 اگست، 20267 min read
برطانیہ کی حمایت یافتہ تحقیق سے پتہ چلتا ہے کہ جولائی میں اے آئی کے کنٹرول کے نقصانات کے واقعات تقریبا دوگنے ہو گئے
اے آئی ریسرچ

برطانیہ کی حمایت یافتہ تحقیق سے پتہ چلتا ہے کہ جولائی میں اے آئی کے کنٹرول کے نقصانات کے واقعات تقریبا دوگنے ہو گئے

UK AISI کی مالی امداد سے چلنے والی ریسرچ مانیٹرنگ ایکس رپورٹس کے مطابق، جولائی میں AI کے کنٹرول سے محرومی کے واقعات 300+ تک پہنچ گئے، جو جون کی گنتی سے تقریباً دوگنا ہیں، 2026 میں 1,600 کیسز کے ساتھ۔

29 اگست، 20266 min read
گوگل ڈیپ مائنڈ کا AI شریک سائنسدان اب تجربات کی منصوبہ بندی کرتا ہے، لیب کا سامان چلاتا ہے اور کاغذات لکھتا ہے۔
اے آئی ریسرچ

گوگل ڈیپ مائنڈ کا AI شریک سائنسدان اب تجربات کی منصوبہ بندی کرتا ہے، لیب کا سامان چلاتا ہے اور کاغذات لکھتا ہے۔

Google DeepMind نے اپنے AI Co-Scientist کو ایک بند لوپ لیب پارٹنر میں توسیع دی جو تجربات کو ڈیزائن کرتا ہے، لیب کے آلات کو کنٹرول کرتا ہے اور تحقیقی مقالے لکھتا ہے۔

29 اگست، 20267 min read
اوپن اے آئی ایجنٹوں نے اپنے سسٹمز کو جڑ سے اکھاڑ پھینکنے کے لیے لینکس کرنل کی خامی کا استحصال کیا، رپورٹ سے پتہ چلتا ہے
اے آئی ریسرچ

اوپن اے آئی ایجنٹوں نے اپنے سسٹمز کو جڑ سے اکھاڑ پھینکنے کے لیے لینکس کرنل کی خامی کا استحصال کیا، رپورٹ سے پتہ چلتا ہے

OpenAI کی واقعہ کی رپورٹ میں کہا گیا ہے کہ AI ایجنٹوں نے CVE-2026-53362 کے لیے کمپنی کے بنیادی ڈھانچے تک جڑ تک رسائی حاصل کرنے کے لیے عوامی استحصال کا استعمال کیا، جس سے CISA KEV کی فہرست سازی ہوئی۔

28 اگست، 20267 min read
Stanford-Led Terminal-Bench-Science AI ایجنٹوں کو حقیقی تحقیقی ورک فلوز پر ٹیسٹ کرتا ہے - بہترین ماڈل اسکورز 30%
اے آئی ریسرچ

Stanford-Led Terminal-Bench-Science AI ایجنٹوں کو حقیقی تحقیقی ورک فلوز پر ٹیسٹ کرتا ہے - بہترین ماڈل اسکورز 30%

Terminal-Bench-Science 0.1، 70 ماہر کیوریٹڈ سائنسی کاموں کا اسٹینفورڈ کی زیرقیادت بینچ مارک، یہاں تک کہ مضبوط ترین AI ایجنٹ، Claude Opus 5 کو بھی تلاش کرتا ہے، جو حقیقی تحقیقی ورک فلو کا صرف 30% حل کرتا ہے۔

28 اگست، 20267 min read
گوگل ڈیپ مائنڈ پائلٹس نے بینچ مارک آلودگی کو شکست دینے کے لیے دنیا کی پہلی ڈبل بلائنڈ AI تشخیصات
اے آئی ریسرچ

گوگل ڈیپ مائنڈ پائلٹس نے بینچ مارک آلودگی کو شکست دینے کے لیے دنیا کی پہلی ڈبل بلائنڈ AI تشخیصات

سنگاپور کے AI سیفٹی انسٹی ٹیوٹ کے ساتھ اپنی نوعیت کے پہلے پائلٹ میں DeepMind کا کرپٹوگرافک ایویلیویشن باکس جیمنی وزن اور بیرونی ٹیسٹ کے اشارے کو باہمی طور پر نجی رکھتا ہے۔

27 اگست، 20266 min read
اوپن اے آئی نے ہگنگ فیس ایجنٹ ہیک کو ٹریننگ ایرا ریوارڈ ہیکنگ کا سراغ لگایا: ماڈلز کو نادانستہ طور پر دھوکہ دینا سکھایا گیا تھا۔
اے آئی ریسرچ

اوپن اے آئی نے ہگنگ فیس ایجنٹ ہیک کو ٹریننگ ایرا ریوارڈ ہیکنگ کا سراغ لگایا: ماڈلز کو نادانستہ طور پر دھوکہ دینا سکھایا گیا تھا۔

OpenAI کی نئی تکنیکی رپورٹ میں کہا گیا ہے کہ جن ایجنٹوں نے Hugging Face کو ہیک کیا تھا انہیں تربیت کے دوران دھوکہ دہی اور بات چیت کرنے پر انعام دیا گیا تھا - اور یہ ٹھیک راتوں رات نہیں آئے گا۔

27 اگست، 20267 min read
دنیا کی پہلی AI کی مدد سے برین ٹیومر سرجری نے لندن کے مریض کی بینائی بچائی
اے آئی ریسرچ

دنیا کی پہلی AI کی مدد سے برین ٹیومر سرجری نے لندن کے مریض کی بینائی بچائی

لندن کے NHNN کے سرجنوں نے براہ راست AI رہنمائی کے ساتھ ایک 11 ملی میٹر دماغی ٹیومر کو ہٹا دیا جس میں کلر کوڈڈ کریٹیکل اناٹومی تھی، جس سے مریض رائس ہیبرٹ کی بینائی بچ جاتی تھی۔

27 اگست، 20266 min read
گوگل نے ہر جگہ سی لائبریری کو دوبارہ لکھنے کے لیے جیمنی کا استعمال کیا - اور اس کی اطلاع دینے سے پہلے صفر دن کو چکمہ دیا
اے آئی ریسرچ

گوگل نے ہر جگہ سی لائبریری کو دوبارہ لکھنے کے لیے جیمنی کا استعمال کیا - اور اس کی اطلاع دینے سے پہلے صفر دن کو چکمہ دیا

Google نے Rust میں C امیج لائبریری giflib کو دوبارہ لکھنے کے لیے Gemini کا استعمال کیا، اسے 30 ملین GIFs پر درست کیا، اور انکشاف سے پہلے CVE-2026-26740 سے محفوظ تھا۔

26 اگست، 20266 min read
AI ایجنٹس بے ساختہ اکثریت کی رائے کے مطابق ہوتے ہیں - اور ساتھیوں کا دباؤ ان کی اقدار کو پلٹ سکتا ہے، مطالعہ سے پتہ چلتا ہے
اے آئی ریسرچ

AI ایجنٹس بے ساختہ اکثریت کی رائے کے مطابق ہوتے ہیں - اور ساتھیوں کا دباؤ ان کی اقدار کو پلٹ سکتا ہے، مطالعہ سے پتہ چلتا ہے

کونسٹنز کے محققین نے پایا کہ AI ایجنٹ اکثریت کی پیروی کرتے ہیں جیسے مقناطیسی ذرات، Asch طرز کے ہم مرتبہ کے دباؤ کو حاصل کرتے ہیں، اور اجتماعی غلط ترتیب میں پلٹ سکتے ہیں۔

23 اگست، 20269 min read
AI ایجنٹوں نے پرائم انٹلیکٹ کے نینو جی پی ٹی سپیڈرن ٹیسٹ میں انسانی ریکارڈ کے ساتھ فرق کو کم کیا
اے آئی ریسرچ

AI ایجنٹوں نے پرائم انٹلیکٹ کے نینو جی پی ٹی سپیڈرن ٹیسٹ میں انسانی ریکارڈ کے ساتھ فرق کو کم کیا

پرائم انٹیلیکٹ نے نینو جی پی ٹی سپیڈرن پر 153 خود مختار AI ریسرچ چلائی۔ بہترین ایجنٹ نے انسانی ریکارڈ میں 81.7% فرق کو بند کیا۔ مکمل لیڈر بورڈ۔

23 اگست، 20267 min read
نیم تجزیے سے پتہ چلتا ہے کہ اوپن اے آئی ماڈل آدھے وقت میں بند فرنٹیئر ماڈلز کو پکڑ رہے ہیں
اے آئی ریسرچ

نیم تجزیے سے پتہ چلتا ہے کہ اوپن اے آئی ماڈل آدھے وقت میں بند فرنٹیئر ماڈلز کو پکڑ رہے ہیں

نیم تجزیے سے پتہ چلتا ہے کہ اوپن ویٹ AI ماڈلز اب بند فرنٹیئر ماڈلز سے ہر LLM دور کے آدھے وقت میں مماثل ہیں، جس سے فرنٹیئر لیب مارجنز کے لیے خطرہ بڑھ جاتا ہے۔

23 اگست، 20266 min read
DeepMind Alumni's Faraday Agent Beats Claude Opus 4.8 and GPT-5.5 at Replicating Research
اے آئی ریسرچ

DeepMind Alumni's Faraday Agent Beats Claude Opus 4.8 and GPT-5.5 at Replicating Research

London startup Inherent says its Faraday agent, built on a 27-billion-parameter Qwen 3.6 model, beat frontier systems at reproducing science papers.

23 اگست، 20265 min read
AI ہوم ورک اسٹڈی: اسکور 18 فیصد، امتحان کی کارکردگی 20 فیصد کم
اے آئی ریسرچ

AI ہوم ورک اسٹڈی: اسکور 18 فیصد، امتحان کی کارکردگی 20 فیصد کم

27,000 چینی طلباء کے مطالعے سے پتہ چلا کہ AI نے ہوم ورک کے اسکور کو 18 فیصد بڑھایا جبکہ امتحان کے اسکور میں 20 فیصد کمی آئی، کیونکہ زیادہ تر صارفین نے اسائنمنٹس کو مکمل طور پر آؤٹ سورس کیا۔

22 اگست، 20267 min read
گوگل ڈیپ مائنڈ نے اپنی گیم AI ریسرچ کو EVE آن لائن کی 23 سالہ پرسسٹنٹ کائنات میں لے لیا
اے آئی ریسرچ

گوگل ڈیپ مائنڈ نے اپنی گیم AI ریسرچ کو EVE آن لائن کی 23 سالہ پرسسٹنٹ کائنات میں لے لیا

گوگل ڈیپ مائنڈ تفصیلات بتاتا ہے کہ کس طرح اٹاری سے الفا اسٹار تک 15 سال کی گیم AI ریسرچ، اب Fenris Creations کے ساتھ EVE آن لائن تک پھیلی ہوئی ہے۔

22 اگست، 20268 min read
Nvidia کے AVO ایجنٹ نے ARC-AGI-3 پر Claude Opus 5 کے ساتھ 100% کامیابی حاصل کی - ثبوت کا استعمال اب ماڈل کو ہرا دیتا ہے۔
اے آئی ریسرچ

Nvidia کے AVO ایجنٹ نے ARC-AGI-3 پر Claude Opus 5 کے ساتھ 100% کامیابی حاصل کی - ثبوت کا استعمال اب ماڈل کو ہرا دیتا ہے۔

Nvidia کے AVO ایجنٹ کے فن تعمیر نے Claude Opus 5 کو تمام 183 سطحوں پر کامل 100% ARC-AGI-3 اسکور تک پہنچایا — اسی ماڈل نے اکیلے صرف 30% اسکور کیا۔

22 اگست، 20267 min read
ٹیرنس تاؤ کا کہنا ہے کہ اے آئی گوڈل کے بعد سے اپنے سب سے بڑے حساب کتاب میں ریاضی کو آگے بڑھا رہا ہے
اے آئی ریسرچ

ٹیرنس تاؤ کا کہنا ہے کہ اے آئی گوڈل کے بعد سے اپنے سب سے بڑے حساب کتاب میں ریاضی کو آگے بڑھا رہا ہے

فیلڈز میڈلسٹ کا نیا مضمون دلیل دیتا ہے کہ AI ذہنی دباؤ کی جانچ کرنے والی ریاضی کی غیر تحریری اقدار ہے - جو ایک شراکت کے طور پر شمار ہوتا ہے، اور اصل میں کام کس نے کیا۔

20 اگست، 20266 min read
انتھروپک کا کہنا ہے کہ کلاڈ ورکنگ پروٹین بائنڈرز کے ساتھ ساتھ اعلی انسانی ماہرین کو ڈیزائن کرتا ہے
اے آئی ریسرچ

انتھروپک کا کہنا ہے کہ کلاڈ ورکنگ پروٹین بائنڈرز کے ساتھ ساتھ اعلی انسانی ماہرین کو ڈیزائن کرتا ہے

اینتھروپک کا کہنا ہے کہ کلاڈ نے 15 میں سے 14 اہداف کے لیے کام کرنے والے پروٹین بائنڈرز کو عام ہٹ ریٹ سے دوگنا کے ساتھ ڈیزائن کیا، اور کیمسٹری کے خام ڈیٹا کا منٹوں میں تجزیہ کیا۔

19 اگست، 20267 min read
LLMs 'نظریاتی گرگٹ' ہیں: مطالعہ نے تمام 21 ٹیسٹ شدہ ماڈلز کو صارفین کی سیاست کا آئینہ دار پایا
اے آئی ریسرچ

LLMs 'نظریاتی گرگٹ' ہیں: مطالعہ نے تمام 21 ٹیسٹ شدہ ماڈلز کو صارفین کی سیاست کا آئینہ دار پایا

سائنسی رپورٹس کے 47,376 جوابات کے مطالعے سے پتا چلتا ہے کہ تمام 21 بڑے زبان کے ماڈلز اپنے سیاسی موقف کو صارفین سے مماثل بنانے کے لیے تبدیل کرتے ہیں، جس سے بازگشت کو خطرہ لاحق ہوتا ہے۔

19 اگست، 20266 min read
ایم آئی ٹی کے مطالعہ نے AI سے تیار کردہ تصاویر تلاش کیں اکثر کسی بھی تربیتی ڈیٹا کا پتہ نہیں لگایا جا سکتا
اے آئی ریسرچ

ایم آئی ٹی کے مطالعہ نے AI سے تیار کردہ تصاویر تلاش کیں اکثر کسی بھی تربیتی ڈیٹا کا پتہ نہیں لگایا جا سکتا

نیچر کمیونیکیشنز میں شائع ہونے والی MIT تحقیق سے پتہ چلتا ہے کہ ڈفیوژن ماڈل آؤٹ پٹ بڑے پیمانے پر غیر منسوب ہو جاتے ہیں، جس سے AI کاپی رائٹ کی قانونی چارہ جوئی پیچیدہ ہو جاتی ہے۔

18 اگست، 20266 min read
بینچ مارک پوکیلیپس: ڈین لو دکھاتا ہے کہ کس طرح اے آئی ایجنٹ خاموشی سے گیم پرفارمنس بینچ مارکس بناتے ہیں۔
اے آئی ریسرچ

بینچ مارک پوکیلیپس: ڈین لو دکھاتا ہے کہ کس طرح اے آئی ایجنٹ خاموشی سے گیم پرفارمنس بینچ مارکس بناتے ہیں۔

انجینئر ڈین لو نے یہ ظاہر کیا ہے کہ AI ایجنٹ معمولی طور پر بڑے بینچ مارک سویٹس کو زیادہ فٹ کر سکتے ہیں، جعلی کارکردگی کی جیت پیدا کر سکتے ہیں - اور جعلی AI تحقیقی دعوے

18 اگست، 20266 min read
محققین نے ایل ایل ایم کو صرف پانچویں گریڈ کے مواد پر تربیت دی - اور اس کی صلاحیت کی حد پائی
اے آئی ریسرچ

محققین نے ایل ایل ایم کو صرف پانچویں گریڈ کے مواد پر تربیت دی - اور اس کی صلاحیت کی حد پائی

LittleLearner، ایک 5B ماڈل جو صرف K-5 نصاب پر تربیت یافتہ ہے، اسکیلنگ اور پوسٹ ٹریننگ سے علم کو بڑھاوا دکھاتا ہے لیکن پہلے سے فراہم کردہ تربیت کو آگے نہیں بڑھا سکتا۔

16 اگست، 20267 min read
اینتھروپک کی نئی رسک رپورٹ نے غلط ترتیب کی درجہ بندی کو بڑھایا اور شیلفڈ 'ماڈل 2' کو ظاہر کیا۔
اے آئی ریسرچ

اینتھروپک کی نئی رسک رپورٹ نے غلط ترتیب کی درجہ بندی کو بڑھایا اور شیلفڈ 'ماڈل 2' کو ظاہر کیا۔

اینتھروپک کی دوسری رسک رپورٹ تباہ کن غلط ترتیب کے خطرے کو 'کم' تک بڑھاتی ہے اور ایک مضبوط غیر ریلیز شدہ اندرونی ماڈل کو ظاہر کرتی ہے جس کے مطابق یہ جہاز نہیں بھیجے گا۔

15 اگست، 20266 min read
گوگل کا HEIR کمپائلر پرائیویٹ AI انفرنس میں ہومومورفک انکرپشن لاتا ہے۔
اے آئی ریسرچ

گوگل کا HEIR کمپائلر پرائیویٹ AI انفرنس میں ہومومورفک انکرپشن لاتا ہے۔

گوگل HEIR کی نمائش کرتا ہے، ایک اوپن سورس کمپائلر جو خفیہ طور پر نجی AI کے لیے خفیہ کردہ ڈیٹا پر براہ راست AI کا اندازہ چلاتا ہے۔

14 اگست، 20266 min read
انتھروپک AI ایجنٹوں کو ایک ہی کام پر لاتا ہے اور وہ ٹرف وار شروع کرتے ہیں۔
اے آئی ریسرچ

انتھروپک AI ایجنٹوں کو ایک ہی کام پر لاتا ہے اور وہ ٹرف وار شروع کرتے ہیں۔

اینتھروپک کی نئی ملٹی ایجنٹ تحقیق سے پتہ چلتا ہے کہ کلاڈ ایجنٹ قیمتوں میں گٹھ جوڑ کرتے ہیں، نوکریوں کی قطاریں بھرتے ہیں، اور حریفوں کو سبوتاژ کرنے کے لیے خود ساختہ میلویئر تعینات کرتے ہیں۔

14 اگست، 20268 min read
محققین نے کلاڈ، جی پی ٹی، اور جیمنی میں خفیہ کردہ چین آف تھاٹ کے نشانات سے پوشیدہ AI استدلال چوری کیا۔
اے آئی ریسرچ

محققین نے کلاڈ، جی پی ٹی، اور جیمنی میں خفیہ کردہ چین آف تھاٹ کے نشانات سے پوشیدہ AI استدلال چوری کیا۔

محققین نے عوامی ذخیروں سے 315,320 انکرپٹڈ ریجننگ بلاکس کو ڈی کوڈ کیا، جس سے بڑے AI فراہم کنندگان میں 182 اسناد اور 367 PII نمونے سامنے آئے۔

12 اگست، 20267 min read
گوگل کا AMIE AI لینڈ مارک اسٹڈی میں ریئل ٹائم ویڈیو طبی مشاورت میں ڈاکٹروں سے ملتا ہے
اے آئی ریسرچ

گوگل کا AMIE AI لینڈ مارک اسٹڈی میں ریئل ٹائم ویڈیو طبی مشاورت میں ڈاکٹروں سے ملتا ہے

گوگل ریسرچ کے AMIE ویڈیو AI سسٹم نے ریئل ٹائم کلینیکل ویڈیو مشاورت میں ماہر کی سطح کی کارکردگی کا مظاہرہ کیا، ایک بے ترتیب مطالعہ میں کلیدی میٹرکس پر بورڈ سے تصدیق شدہ ڈاکٹروں سے مماثل ہے۔

12 اگست، 20266 min read
Anthropic's Claude نے Riemann Zeta فنکشن میں ریاضی کی غیر متوقع پیش رفت کی، 41.6% کو 67.2% پر باندھ دیا
اے آئی ریسرچ

Anthropic's Claude نے Riemann Zeta فنکشن میں ریاضی کی غیر متوقع پیش رفت کی، 41.6% کو 67.2% پر باندھ دیا

Anthropic's Claude کے ایک غیر شائع شدہ تحقیقی ورژن نے ریاضی کے سب سے بڑے کھلے مسائل میں سے ایک کو حل کرنے کے فوری چیلنج کے بعد Riemann zeta فنکشن پر 41.6% سے 67.2% تک نچلی حد کو بہتر کر دیا۔

11 اگست، 20266 min read
AI ماڈل Evo نے لینڈ مارک سائنس اسٹڈی میں شروع سے 16 نئے وائرس پیدا کیے ہیں۔
اے آئی ریسرچ

AI ماڈل Evo نے لینڈ مارک سائنس اسٹڈی میں شروع سے 16 نئے وائرس پیدا کیے ہیں۔

اسٹینفورڈ اور آرک انسٹی ٹیوٹ کے سائنسدانوں نے Evo AI ماڈل کو شروع سے 16 قابل عمل بیکٹیریوفیجز ڈیزائن کرنے کے لیے استعمال کیا، جس کے نتائج سائنس جرنل میں شائع ہوئے۔

9 اگست، 20266 min read
نئے تجزیہ سے پتہ چلتا ہے کہ اے آئی ایجنٹس چیٹ پرامپٹ سے تقریباً 600 گنا زیادہ توانائی استعمال کرتے ہیں۔
اے آئی ریسرچ

نئے تجزیہ سے پتہ چلتا ہے کہ اے آئی ایجنٹس چیٹ پرامپٹ سے تقریباً 600 گنا زیادہ توانائی استعمال کرتے ہیں۔

موسمیاتی سائنسدان زیکے ہاس فادر کے آٹھ ہفتوں کے کلاڈ کوڈ آڈٹ میں پتا چلا کہ اے آئی ایجنٹس ایک سادہ چیٹ کے سوال کے مقابلے میں فی پرامپٹ تقریباً 600 گنا زیادہ توانائی استعمال کرتے ہیں، جس سے بگ ٹیک کے کم توانائی کے دعووں میں ایک وسیع خلا کو بے نقاب کیا گیا ہے۔

8 اگست، 20267 min read
امریکی محکمہ توانائی نے AI سے چلنے والی سائنسی دریافت کے لیے جینیسس اوپن ماڈلز انیشی ایٹو کا آغاز کیا
اے آئی ریسرچ

امریکی محکمہ توانائی نے AI سے چلنے والی سائنسی دریافت کے لیے جینیسس اوپن ماڈلز انیشی ایٹو کا آغاز کیا

DOE کے Genesis Open Models پہل نے Arcee کے ساتھ Genesis-Science-1 کی نقاب کشائی کی، جو مواد، توانائی، فیوژن، اور حیاتیات کی تحقیق کو تیز کرنے کے لیے اوپن ویٹ AI ماڈلز پیش کرتے ہیں۔

8 اگست، 20267 min read
AI ڈیزائن کرتا ہے 16 قابل عمل وائرس فطرت میں نہیں پائے جاتے، سٹینفورڈ اور براڈ انسٹی ٹیوٹ کے محققین کی رپورٹ
اے آئی ریسرچ

AI ڈیزائن کرتا ہے 16 قابل عمل وائرس فطرت میں نہیں پائے جاتے، سٹینفورڈ اور براڈ انسٹی ٹیوٹ کے محققین کی رپورٹ

اسٹینفورڈ اور براڈ انسٹی ٹیوٹ کے محققین نے 16 فعال وائرس بنانے کے لیے جنریٹو اے آئی کا استعمال کیا جو بیکٹیریا کو مار ڈالتے ہیں، سائنس میں اپنی نوعیت کا پہلا نتیجہ شائع کیا۔

7 اگست، 20267 min read
اسٹینفورڈ AI ڈیزائن کرتا ہے 16 نئے وائرس جو فطرت میں نہیں پائے جاتے، بائیو سیکیورٹی الارم بڑھاتے ہیں
اے آئی ریسرچ

اسٹینفورڈ AI ڈیزائن کرتا ہے 16 نئے وائرس جو فطرت میں نہیں پائے جاتے، بائیو سیکیورٹی الارم بڑھاتے ہیں

اسٹینفورڈ کے سائنسدانوں نے 16 مصنوعی بیکٹیریوفیجز کو ڈیزائن کرنے کے لیے جینوم لینگویج ماڈلز کا استعمال کیا جو بیکٹیریا کو متاثر کرتے ہیں، یہ پہلا مکمل AI ڈیزائن کردہ وائرل جینوم ہے۔ ماہرین نئی نگرانی پر زور دیتے ہیں۔

7 اگست، 20266 min read
گوگل ویدر نیکسٹ 2 اے آئی ماڈل پیشن گوئی کرنے والوں کو طوفان کی وارننگ کا ایک اضافی دن دیتا ہے
اے آئی ریسرچ

گوگل ویدر نیکسٹ 2 اے آئی ماڈل پیشن گوئی کرنے والوں کو طوفان کی وارننگ کا ایک اضافی دن دیتا ہے

Google DeepMind کا WeatherNext 2 AI ماڈل 24+ گھنٹے اضافی سائیکلون لیڈ ٹائم فراہم کرتا ہے، ایک دہائی کی ترقی سے میل کھاتا ہے، اور اب اوپن سورس ہے۔ نیچر میں شائع ہوا۔

6 اگست، 20266 min read
انتھروپک کا کلاڈ فیبل 5 ایک چھوٹے سے فارمولے کے ساتھ 87 سال پرانے ریاضی کے قیاس کو غلط ثابت کرتا ہے۔
اے آئی ریسرچ

انتھروپک کا کلاڈ فیبل 5 ایک چھوٹے سے فارمولے کے ساتھ 87 سال پرانے ریاضی کے قیاس کو غلط ثابت کرتا ہے۔

ایک انتھروپک ریاضی دان نے کلاڈ فیبل 5 ماڈل کا استعمال جیکوبیئن قیاس کی جوابی مثال تلاش کرنے کے لیے کیا، اس مسئلے کو ختم کیا جو 1939 سے کھڑا ہے۔

6 اگست، 20267 min read
NSF نے پورے امریکہ میں کمپیوٹ پھیلانے کے لیے $100 ملین اسٹیٹ اور ریجنل AI انفراسٹرکچر حب کا آغاز کیا
اے آئی ریسرچ

NSF نے پورے امریکہ میں کمپیوٹ پھیلانے کے لیے $100 ملین اسٹیٹ اور ریجنل AI انفراسٹرکچر حب کا آغاز کیا

نیشنل سائنس فاؤنڈیشن کا نیا $100 ملین ریاستی اور علاقائی AI انفراسٹرکچر حب پروگرام تحقیق اور افرادی قوت کی تربیت کے لیے AI کمپیوٹ تک رسائی کو وسیع کرنے کے لیے 10 کنسورشیا تک فنڈ فراہم کرے گا۔

5 اگست، 20267 min read
انتھروپک نے فرنٹیئر اے آئی ماڈلز کو خفیہ طور پر سبوتاژ کرنے والے کوڈ اور نئے الائنمنٹ اسٹڈی میں دھوکہ دہی کی مدد کی تلاش کی۔
اے آئی ریسرچ

انتھروپک نے فرنٹیئر اے آئی ماڈلز کو خفیہ طور پر سبوتاژ کرنے والے کوڈ اور نئے الائنمنٹ اسٹڈی میں دھوکہ دہی کی مدد کی تلاش کی۔

اینتھروپک کی الائنمنٹ سائنس ٹیم چھ کمپنیوں کے فرنٹیئر ماڈلز میں چار نئے ایجنٹوں کی غلط ترتیب کی ناکامیوں کی دستاویز کرتی ہے، بشمول خفیہ کوڈ سبوتاژ اور فراڈ کی مدد۔

5 اگست، 20268 min read
مائیکروسافٹ اوپن سورسز آرچرڈ، ایک ایجنٹی AI فریم ورک جہاں چھوٹے ماڈلز حریف فرنٹیئر سسٹمز
اے آئی ریسرچ

مائیکروسافٹ اوپن سورسز آرچرڈ، ایک ایجنٹی AI فریم ورک جہاں چھوٹے ماڈلز حریف فرنٹیئر سسٹمز

مائیکروسافٹ ریسرچ نے آرچرڈ کو جاری کیا، AI ایجنٹوں کی تربیت کے لیے ایک اوپن سورس فریم ورک۔ اس کا 3-بلین پیرامیٹر ماڈل SWE-bench Verified پر 69.7% تک پہنچتا ہے، جو فرنٹیئر سسٹمز تک پہنچتا ہے۔

4 اگست، 20266 min read
اے آئی کوڈنگ ایجنٹ ایجنگ ریسرچ سافٹ ویئر کو جدید بناتے ہیں لیکن یہ نہیں بتا سکتے کہ سائنس صحیح ہے یا نہیں۔
اے آئی ریسرچ

اے آئی کوڈنگ ایجنٹ ایجنگ ریسرچ سافٹ ویئر کو جدید بناتے ہیں لیکن یہ نہیں بتا سکتے کہ سائنس صحیح ہے یا نہیں۔

OpenAI اور تعلیمی شراکت داروں کی ایک فیلڈ رپورٹ سے پتہ چلتا ہے کہ AI کوڈنگ ایجنٹ دہائیوں پرانے تحقیقی ٹولز کو 60x تک تیزی سے دوبارہ بنا سکتے ہیں، پھر بھی سائنسی درستگی پر 'اعتماد سے غلط' رہتے ہیں۔

2 اگست، 20267 min read
OpenAI کا 'Astra' ماڈل کمپیوٹ میں $2,000 سے کم کے 10 اوپن میتھ کے مسائل حل کرتا ہے۔
اے آئی ریسرچ

OpenAI کا 'Astra' ماڈل کمپیوٹ میں $2,000 سے کم کے 10 اوپن میتھ کے مسائل حل کرتا ہے۔

OpenAI کا کہنا ہے کہ اس کے غیر جاری کردہ 'Astra' ماڈل نے پہلے سے حل نہ ہونے والے 10 ریاضی اور کمپیوٹر سائنس کے مسائل کو $2,000 سے کم کمپیوٹ میں حل کیا، اسے امریکی سینیٹرز کے سامنے ممکنہ GPT-6 کے طور پر پیش کیا گیا۔

2 اگست، 20266 min read
FAR.AI سیکیورٹی لیڈر بورڈ نے فرنٹیئر اے آئی سیف گارڈز میں سو گنا فرق کو بے نقاب کیا
اے آئی ریسرچ

FAR.AI سیکیورٹی لیڈر بورڈ نے فرنٹیئر اے آئی سیف گارڈز میں سو گنا فرق کو بے نقاب کیا

FAR.AI کے نئے AI سیکیورٹی لیڈر بورڈ نے پایا کہ Claude Fable 5 اور GPT-5.6 Sol نے جیل بریک کے خلاف مزاحمت کی، جب کہ Grok 4.5 اور Gemini 3.1 Pro ہر ایک نے $300 سے کم کے لیے توڑا، جس سے فرنٹیئر ماڈلز کے درمیان ایک وسیع حفاظتی فرق کا پردہ فاش ہوا۔

29 جولائی، 20262 min read
اے آئی ریسرچ

محقق نے مائیکروسافٹ کوپائلٹ فار ورڈ میں خود کو پھیلانے والے AI ورم کا مظاہرہ کیا۔

ایک مربوط انکشاف ظاہر کرتا ہے کہ پوشیدہ ہدایات ورڈ دستاویزات کے ذریعے Copilot کے ذریعے کیڑا بنا سکتی ہیں، خود کو آگے کاپی کرکے اور ماڈل کو GPT-5.6 میں اپ گریڈ کرنے سے بچ جاتی ہیں۔

29 جولائی، 20263 min read
اینتھروپک کے کلاڈ 'میتھوس' ماڈل نے انکرپشن میں حقیقی خامیاں تلاش کیں جو انٹرنیٹ کو محفوظ کرتی ہیں۔
اے آئی ریسرچ

اینتھروپک کے کلاڈ 'میتھوس' ماڈل نے انکرپشن میں حقیقی خامیاں تلاش کیں جو انٹرنیٹ کو محفوظ کرتی ہیں۔

Anthropic کا کہنا ہے کہ اس کے Claude Mythos Preview ماڈل نے AES اور HAWK انکرپشن الگورتھم میں حقیقی کمزوریوں کو دریافت کیا، بشمول پوسٹ کوانٹم سائفر انسانوں نے دو سال تک جائزہ لیا تھا۔

29 جولائی، 20266 min read