Anthropic نے جمعرات، 4 ستمبر 2026 کو اعلان کیا کہ Claude نے Fermat کے Last Theorem کا پہلا مکمل کمپیوٹر چیک شدہ ثبوت تیار کیا ہے، جو کہ ریاضی کے سب سے مشہور نتائج میں سے ایک ہے، جو کہ 11 دنوں میں بڑے پیمانے پر خود مختاری سے کام کرتا ہے اور لین پروگرامنگ زبان میں کوڈ کی 13 ملین لائنیں لکھتا ہے، کمپنی کے سرکاری اعلان کے مطابق۔
اس سنگ میل نے تحقیقی برادری کی فوری توجہ مبذول کرائی، اشاعت کے چند گھنٹوں کے اندر ہیکر نیوز کو سرفہرست رکھا۔ نظریہ کے ایک باضابطہ ثبوت کی توقع کی گئی تھی کہ کثیر سالہ کمیونٹی کی کوششیں لگیں گی۔ اس کے بجائے، درجنوں تعاون کرنے والے کلاڈ ایجنٹوں کی ایک ٹیم نے دو ہفتوں سے کم عرصے میں کام مکمل کیا۔ AI کی صلاحیتیں آج کہاں کھڑی ہیں اس بارے میں مزید سیاق و سباق کے لیے، ہماری تازہ ترین AI پیش رفت دیکھیں۔
فرمیٹ کا آخری نظریہ کیا ہے - اور اس نے 350 سالوں تک ثبوت کی مزاحمت کیوں کی
فرمیٹ کا آخری نظریہ کہتا ہے کہ کوئی بھی مثبت عدد a, b, اور c 2 سے زیادہ n کی کسی بھی قدر کے لیے aⁿ + bⁿ = cⁿ کی مساوات کو پورا نہیں کر سکتا۔ پیئر ڈی فرمیٹ نے 1637 کے آس پاس ڈیوفینٹس کی ارتھمیٹیکا کی اپنی نقل کے حاشیے میں اس دعوے کو جوڑ دیا تھا، جس میں اب اس نے اس کا اضافہ نہیں کیا تھا۔ ثبوت جس پر مشتمل مارجن بہت تنگ تھا۔
تین صدیوں سے زیادہ عرصے تک یہ قیاس اس کو ثابت کرنے کی ہر کوشش کو ختم کرتا رہا۔ اینتھروپک کے اکاؤنٹ کے مطابق، 1908 میں اعلان کردہ 100,000 جرمن گولڈ مارکس کے انعام نے صرف اپنے پہلے سال میں 621 غلط کوششیں کیں۔ سر اینڈریو وائلز نے بالآخر 1993 میں ایک درست ثبوت پیش کیا — صرف جائزہ لینے والوں کے لیے تصدیق میں دو ماہ کے ایک اہم وقفے کو بے نقاب کرنے کے لیے۔ وائلز نے مئی 1995 میں 129 صفحات پر مشتمل حتمی ورژن شائع کرنے سے پہلے اپنے سابق طالب علم رچرڈ ٹیلر کے ساتھ ثبوت کی مرمت میں ایک سال گزارا، جس کی تصدیق کے لیے مہینوں کی محنت لگ گئی۔
کلاڈ نے 13 ملین لائن پروف کیسے بنایا
اس منصوبے کی شروعات تیانی پینگ نے کی تھی، جو ایک انتھروپک محقق ہے جس کا گروپ کولمبیا یونیورسٹی میں AI کو باضابطہ بنانے کے لیے ٹولز بناتا ہے، جو یہ جانچنے کے لیے نکلا تھا کہ آیا کلاڈ وائلز کے ثبوت کو مشین سے جانچنے کے قابل شکل میں تبدیل کرنے میں پیش رفت کر سکتا ہے۔
نقطہ نظر کی تبدیلی کے بعد ہی کوشش کامیاب ہوئی۔ اینتھروپک کی رپورٹ ہے کہ ایجنٹوں کی ابتدائی کوششیں ناکام ہو گئیں کیونکہ وہ پروجیکٹ کی حالت سے باخبر ہو گئے اور مؤثر طریقے سے تعاون کرنا چھوڑ دیا۔ یہ پیش رفت Prove2Me کے ساتھ ہوئی، جو کہ کولمبیا میں Peng اور معاونین کے ذریعہ ڈیزائن کردہ ریاضی کو باضابطہ بنانے کے لیے ایک کھلا تعاونی پلیٹ فارم ہے۔ پلیٹ فارم تھیوریم سٹیٹمنٹس کا ایک ڈائریکٹڈ تیزابی گراف برقرار رکھتا ہے جسے ایجنٹ یہ فیصلہ کرنے کے لیے استعمال کرتے ہیں کہ آگے کیا ثابت کرنا ہے، بیانات کو ثبوتوں سے الگ کر کے لین کمپلیشن کو تیز کرتا ہے، اور ایجنٹوں کو ہر تھیورم کی فطری زبان کی وضاحتوں کے ذریعے نتائج تلاش کرنے اور دوبارہ استعمال کرنے دیتا ہے۔
کلاڈ کوڈ پر مبنی ملٹی ایجنٹ ہارنس پر چلتے ہوئے، ایجنٹوں کی ٹیم نے ایک اندرونی تحقیقی ماڈل سے تقریباً چھ بلین آؤٹ پٹ ٹوکن استعمال کیے جنہیں Anthropic نے Claude Fable 5.1 سے تقریباً موازنہ کیا ہے۔ انسانی ان پٹ کبھی کبھار اعلیٰ سطحی ہدایات تک محدود تھا — انتھروپک پیغامات کا حوالہ دیتا ہے جیسے کہ "جیکبیان ایک اسکیم کے طور پر اعلیٰ ترجیح لگتا ہے" اور مازور تھیوریم کو جلد ہی انجام دینے کی درخواست کی۔ ثبوت 18 اگست کو 02:00 UTC پر مکمل ہوا، جب پلیٹ فارم کا روٹ تھیوریم ثابت پر پلٹ گیا۔
راستے میں، کلاڈ نے 30,300 تھیومز کو ثابت کیا، ان میں سے 29,500 کو حتمی ثبوت میں استعمال کیا۔ لین کی 13 ملین لائنوں پر، نتیجہ میتھلیب کے سائز سے پانچ گنا زیادہ ہے، جو کہ رسمی ریاضی کی پرنسپل کمیونٹی لائبریری ہے۔ یہ ثبوت ہینری ڈارمون، فریڈ ڈائمنڈ، اور رچرڈ ٹیلر کے ذریعہ وائلز کے دلائل کی ایک آسان وضاحت کے بعد ہے، اور کیون بزارڈ کی سربراہی میں امپیریل کالج لندن کے رسمی منصوبے کے ٹکڑوں کو اپناتا ہے۔
کیوں ایک دبلی پتلی ثبوت سوال کو حل کرتا ہے۔
جو چیز نتیجہ کو فیصلہ کن بناتی ہے وہ ثالث ہے۔ لین جیسے پروف اسسٹنٹ الگورتھمی طور پر ثبوت کی منطق کی تصدیق کرتے ہیں، اور انتھروپک کا کہنا ہے کہ کلاڈ کا ثبوت صرف Lean کے تین معیاری محوروں کا استعمال کرتا ہے، ایک موازنہ کنندہ کے ساتھ اس بات کی تصدیق کرتا ہے کہ تھیوریم کا بیان میتھلیب کی تھیوریم کی اپنی تشکیل سے میل کھاتا ہے۔ کمپنی نے ثبوت بھی GitHub پر عوامی ذخیرہ میں شائع کیا ہے۔
بزارڈ، جس نے نتیجہ کا جائزہ لیا، غیر واضح تھا: "یہ غیر معمولی خودکار کارنامہ، جس کے بارے میں انتھروپک محققین کا کہنا ہے کہ صرف 11 دن لگے، یہ ثابت کرتا ہے کہ ریاضی کے محور کے علاوہ کوئی اور مفروضہ نہیں ہے۔"
انتھروپک نیاپن کو صحیح طریقے سے پوزیشن میں رکھنے میں محتاط ہے۔ ریمن مفروضے پر حالیہ AI سے چلنے والے کام کے برعکس، جس نے نیا ریاضی تیار کیا، یہاں کچھ بھی نیا ریاضی نہیں ہے - کامیابی تصدیق ہے، موجودہ ثبوت کی جانچ کرنا جس طرح کیلکولیٹر ریاضی کو چیک کرتا ہے۔ یہ دیکھتے ہوئے کہ Lean — Anthropic نہیں — درست ہونے کا حتمی اختیار ہے، دعویٰ کمپنی کے اپنے ماڈل کے اپنے جائزے پر منحصر نہیں ہے۔
ریاضی اور AI تحقیق کے لیے اس کا کیا مطلب ہے۔
مضمرات دونوں طریقوں سے کاٹتے ہیں۔ ریاضی دانوں کے لیے، آٹوفارملائزیشن علم کے موجودہ کارپس میں غلطیوں کو پکڑ سکتی ہے اور نئے نتائج کے لیے ریفری کے بوجھ کو ڈرامائی طور پر ہلکا کر سکتی ہے، ایسا عمل جس میں برسوں لگ سکتے ہیں۔ "اگر FLT کی خودکار رسمی شکل اب ممکن ہے، تو ہم نے جدید ریاضیاتی ادب کی خودکار رسمی شکل کی طرف ایک بڑا قدم اٹھایا ہے،" Buzzard نے ایک فالو اپ بلاگ پوسٹ میں لکھا جس کا عنوان ہے "Anthropic نے مجھے اس سے شکست دی ہے،" یہ تسلیم کرتے ہوئے کہ اس کی اپنی کمیونٹی کی قیادت میں 2024 میں شروع کی گئی کوشش کو پیچھے چھوڑ دیا گیا تھا۔
AI لیبز کے لیے، نتیجہ بتاتا ہے کہ رسمی ٹولز ٹیکنالوجی کی سب سے بدنام کمزوریوں میں سے ایک پر لگام ڈال سکتے ہیں۔ اینتھروپک نوٹ کرتا ہے کہ لین لکھنا کلاڈ کو ناول کے نتائج ثابت کرنے میں مدد کرتا ہے، ایجنٹ جزوی رسمی ثبوتوں کا استعمال کرتے ہوئے آزادانہ طور پر مفروضوں کی جانچ پڑتال کرتے ہیں جیسا کہ وہ عددی نقالی لکھتے ہیں۔ کمپنی یہ بھی دلیل دیتی ہے کہ داخلے کی راہ میں رکاوٹ ختم ہو رہی ہے: ایک چھوٹے سے تجربے میں، تین ذاتی کلاڈ میکس منصوبے تین دنوں میں Vinogradov کے تھری پرائمز تھیوریم کو باضابطہ بنانے کے لیے تعاون کرنے والے ایجنٹوں کے لیے کافی تھے۔
انتباہات حقیقی رہیں۔ ثبوت کے لیے ایک مقصد سے تیار کردہ پلیٹ فارم، اربوں ٹوکنز، اور غیر معمولی طور پر صاف کامیابی کے معیار کی ضرورت تھی — پہلے سے موجود جوابی کلید کو چیک کرنا نئے تھیومز کو دریافت کرنے سے زیادہ آسان ہے۔ لیکن ایک مظاہرے کے طور پر کہ اے آئی سسٹم اب فرنٹیئر پر ریاضی کو باضابطہ بنا سکتے ہیں، 358 سال کے مسئلے کے خلاف 11 دن اس بات کو ممکنہ حد تک واضح طور پر پیش کرتے ہیں۔
---
AI سے آگے رہیںتازہ ترین AI خبریں، تجزیہ اور کامیابیاں حاصل کریں — سب ایک جگہ پر۔
مزید AI خبریں پڑھیں →