اینتھروپک نے اس ہفتے اپنی ڈیولپمنٹ پائپ لائن کے اندر اپنی نوعیت کا پہلا منظر شائع کیا، جس میں یہ انکشاف کیا گیا کہ اس کا کلاڈ ماڈل اب کمپنی میں AI ریسرچ اور ڈیولپمنٹ کے 26% کام کی "لیڈ" کرتا ہے - جو فروری 2026 میں 1% سے کم تھا۔ رائٹرز، واشنگٹن پوسٹ، اور دیگر آؤٹ لیٹس۔

پوسٹ جزوی طور پر ایک شفافیت کی مشق ہے اور جزوی طور پر ایک دلیل: اینتھروپک چاہتی ہے کہ دیگر فرنٹیئر لیبز بھی اسی قسم کے نمبر شائع کریں، تاکہ عوام اور حکومتیں اس بات کا پتہ لگا سکیں کہ AI کی تعمیر کے لیے AI کو کتنی جلدی چابیاں سونپی جا رہی ہیں۔ For more context on this story, see our ongoing breaking AI news.

اے آئی ڈیولپمنٹ کو ٹریک کرنے کے لیے تین نمبر

کمپنی نے تین پیمائشیں تجویز کیں جن کے بارے میں یہ کہا گیا ہے کہ فرنٹیئر لیبز کے اندر ترقی کی رفتار کو روشن کریں: AI خود کتنا AI R&D انجام دیتا ہے، AI ایجنٹوں کی کارروائیوں کی کتنی اچھی طرح نگرانی کی جاتی ہے، اور صلاحیت کے کام اور حفاظتی کام کے درمیان کمپیوٹ کو کس طرح مختص کیا جاتا ہے۔

ہیڈ لائن نمبر اس سے آتا ہے جسے اینتھروپک اپنے R&D آٹومیشن انڈیکس کہتے ہیں۔ کمپنی نے کمپنی میں کیے گئے ہر قسم کے AI R&D کام کی فہرست بنائی، اس کی درجہ بندی کی کہ فی الحال ہر کام کتنا خودکار ہے، اور ریسرچ گروپ Epoch AI کے تیار کردہ پیمانے کا استعمال کرتے ہوئے نتائج کو جمع کیا۔ پیمانہ AL0 (کوئی AI ملوث نہیں) سے AL5 تک چلتا ہے (AI مکمل طور پر خود مختار طور پر کام کرتا ہے، جس میں کوئی انسان نہیں ہوتا ہے)، AL3 کا مطلب ہے AI "تعاون کرتا ہے" قریبی انسانی سمت میں کام کے بڑے حصوں پر اور AL4 کا مطلب ہے AI "لیڈز"، ایک اعلی سطحی سپر پرامپٹ سے زیادہ تر کام آخر سے آخر تک مکمل کرتا ہے۔

اگست 2026 تک، Anthropic نے رپورٹ کیا، Claude کمپنی کے AI R&D کام کی 26% قیادت کرتا ہے۔ "AI collaborates" کی سطح پر یا اس سے اوپر کے کام کا حصہ 90% سے اوپر ہے۔ کلاڈ AI R&D کام کے کسی بھی ناپے ہوئے ذیلی سیٹ کے لیے مکمل طور پر خود مختار طور پر کام نہیں کر رہا ہے۔

30,000 ایجنٹس، ایک مانیٹر

دوسری پیمائش نگرانی سے متعلق ہے۔ اینتھروپک نے انکشاف کیا کہ اگست 2026 تک تقریباً 30,000 ایجنٹس کمپنی میں کسی بھی وقت اس کے سب سے زیادہ استعمال ہونے والے اندرونی پلیٹ فارم پر تحقیق اور انجینئرنگ کا کام کر رہے تھے۔

پوسٹ کے مطابق، ان ایجنٹوں کی ہر کارروائی آن لائن مانیٹر سے گزرنے سے پہلے، عام طور پر سیکنڈوں میں ہوتی ہے۔ اینتھروپک کا کہنا ہے کہ اس نے اگست کے دوران اپنے تحقیقی اور انجینئرنگ ایجنٹوں کے ایک ارب سے زیادہ فیصلوں کا تجزیہ کیا اور پایا کہ مانیٹروں کے ذریعہ بلاک یا بڑھائی گئی سرگرمیوں کا حصہ 0.002 فیصد تھا۔

کمپیوٹ ایلوکیشن پر، تیسری پیمائش، کمپنی نے کہا کہ جانچ شدہ ہفتے کے دوران تقریباً 6% کمپیوٹ جو AI R&D میں گئے تھے حفاظت کے لیے مختص کیے گئے تھے۔

اپنا جانشین بنانا — انسانوں کی نگرانی کے ساتھ

فریمنگ اتنی ہی اہمیت رکھتی ہے جتنا کہ اعداد و شمار۔ انتھروپک کے ماڈلز انہی ماڈلز کی اگلی نسل کی تعمیر میں تیزی سے حصہ لے رہے ہیں - جسے محققین خود کو دوبارہ پیدا کرنے والی بہتری کہتے ہیں، اور جسے واشنگٹن پوسٹ کی سرخی نے ایک چیٹ بوٹ کے طور پر "اپنا جانشین بنانے کا کام سنبھالنا" کے طور پر زیادہ واضح طور پر بیان کیا ہے۔

انتھروپک "AI لیڈز" اور "AI کی جگہ لے لیتا ہے" کے درمیان ایک لکیر کھینچنے میں محتاط ہے۔ AL4 میں، ایک انسان اب بھی نگرانی کرتا ہے اور مداخلت کر سکتا ہے۔ کمپنی نے واضح طور پر اطلاع دی کہ اس کے R&D کام کا کوئی ماپا سب سیٹ AL5 پر نہیں چلتا ہے۔ لیکن رفتار بہت تیز ہے: تقریباً سات مہینوں میں 1% سے 26% تک جانے سے پتہ چلتا ہے کہ اگر موجودہ رجحانات برقرار رہے تو AI کی زیر قیادت کام کا حصہ دہائی کے اختتام سے پہلے نصف گزر سکتا ہے۔

طریقہ کار کی حقیقی حدود ہیں، اور انتھروپک ایسا کہتا ہے۔ اس کی آٹومیشن کی درجہ بندی کمپنی کے اپنے کام کے ریکارڈ کے نمونے لے کر تیار کی گئی تھی — بشمول سلیک پیغامات اور اندرونی دستاویزات — اور انسانوں اور جج ماڈل دونوں کے ساتھ یہ بتانا ہے کہ ہر کام کتنا خودکار ہے۔ ایک اندھے ٹیسٹ میں، عملے نے یہ جانے بغیر کاموں کی درجہ بندی کی کہ ماڈلز نے کیا ثبوت جمع کیے ہیں۔ کمپنی نے اطلاع دی کہ اس کے ماڈل جج نے انسانوں کے ساتھ جتنی بار اتفاق کیا انسانوں نے ایک دوسرے سے اتفاق کیا: عین مطابق ماڈل سے انسان کا معاہدہ 59٪ تھا، جب کہ انسان سے انسان کا معاہدہ صرف 35٪ تھا، اور ماڈل اور انسانی درجہ بندی ایک دوسرے کے 97٪ وقت کے اندر ایک سطح کے اندر آتی ہے۔

کمپنی نے اپنے طریقہ کار میں خود حوالہ جاتی خطرے کو بھی تسلیم کیا: انتھروپک نے اپنے سسٹمز کا جائزہ لینے میں مدد کے لیے اپنے ماڈلز کا استعمال کیا، جس کا مطلب یہ ہو سکتا ہے کہ جج ماڈل بھی اسی قسم کی غلطیاں کرتا ہے جس ماڈل کی وہ جانچ کر رہا ہے۔ تیسری پارٹی کی توثیق، اس کا استدلال ہے، اصل جواب ہے۔

باہر کی آنکھیں آرہی ہیں۔

اس مقصد کے لیے، Anthropic کا کہنا ہے کہ وہ کمپنی کے اندر متعدد تنظیموں کے آزاد فریق ثالث تشخیص کاروں کو سرایت کرنے کا ارادہ رکھتا ہے، جس سے انہیں داخلی عمل، سسٹمز اور ڈیٹا تک رسائی فراہم کی جائے جو کہ اندرونی خطرے کی تشخیص کرنے والی ٹیموں کے پاس ہے۔ بیرونی AI تحقیقی غیر منفعتی METR نے پہلے انتھروپک کے آف لائن مانیٹرنگ پلیٹ فارم کو ریڈ ٹیم بنایا ہے۔

یہ انکشاف پیسنگ کے بارے میں بڑھتی ہوئی بحث کے درمیان ہوا ہے۔ اینتھروپک کے سی ای او ڈاریو آمودی نے فرنٹیئر کو سست کرنے پر ہم آہنگی پر زور دیا ہے، اور کمپنی نوٹ کرتی ہے کہ اگر اس طرح کی کوآرڈینیشن موجود ہے تو اس کی اپنی تعداد میں تبدیلی کی توقع کی جائے گی۔ اس ہفتے، اینتھروپک اور اوپن اے آئی بھی حفاظتی ماہرین کے ایک عوامی خط کا موضوع تھے جس میں یہ دلیل دی گئی تھی کہ لیبز کو واقعی خود مختار حفاظتی جائزہ لینے والوں کی ضرورت ہے۔

آیا حریف انتھروپک کی برتری کی پیروی کرتے ہیں یہ کھلا سوال ہے۔ کمپنی کا استدلال ہے کہ کوئی بھی فرنٹیئر ڈویلپر عوامی طریقہ کار کا استعمال کرتے ہوئے ان اقدامات کو باقاعدگی سے شائع کرسکتا ہے۔ جب تک وہ ایسا نہیں کرتے، صرف عوامی نمبرز خود لیبز سے آتے ہیں کہ AI کتنی تیزی سے AI بنا رہا ہے۔

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →