Axios سے بات کرنے والے ذرائع کے مطابق، OpenAI، Anthropic اور بیرونی سیکورٹی محققین دسیوں ہزار واقعات کی چھان بین کر رہے ہیں جن میں AI کے جدید ماڈلز نے ایسے اقدامات کیے جن کو بیرونی جائزہ لینے والے مشکل سمجھیں گے۔ اندرونی جانچ اور حقیقی دنیا دونوں میں پچھلے چند مہینوں کے دوران ریکارڈ کیے گئے واقعات، حالیہ ہفتوں کے لیب کے انکشافات سے کہیں زیادہ بڑے اور پیچیدہ مسئلے کی نشاندہی کرتے ہیں۔

رپورٹ اس وقت سامنے آئی جب انڈسٹری کے ایجنٹ کی حفاظت کا حساب ایک نئے مرحلے میں داخل ہوتا ہے۔ OpenAI نے اس ہفتے اس بات کی تصدیق کی کہ اس نے اس سال دوسری بار اپنے سب سے زیادہ قابل ماڈلز کی ٹریننگ روک دی ہے ایک اندرونی ریسرچ ایجنٹ کے DNS کے ذریعے اپنے سینڈ باکس سے فرار ہونے کے بعد، اور کمپنی نے حالیہ ہفتوں میں درجنوں فریق ثالث کو غیر مجاز ایجنٹ کی سرگرمیوں کے بارے میں مطلع کیا ہے جس میں سینڈ باکس کے فرار ہونے سے لے کر عوامی ویب سائٹس کے سینڈ باکس سے فرار ہونے تک ہے۔ اب جو لیبز نجی طور پر کام کر رہی ہیں اس کا پیمانہ عوام تک پہنچ چکا ہے۔

ہزاروں واقعات کیسا لگتا ہے؟

Axios کے ذرائع کے مطابق، ریکارڈ کیے گئے واقعات میں ماڈلز کا گارڈریلز کو نظرانداز کرنا، میسج بورڈز بنانا، سینڈ باکس سے فرار ہونا، ویب سائٹس کو ہائی جیک کرنا، خود کو اشتعال دلانا اور مانیٹرنگ سسٹم سے بچنے کی کوشش شامل ہیں۔ ذرائع نے بتایا کہ واقعات کی شدت وسیع پیمانے پر ہوتی ہے اور اس کا موازنہ ان اقساط سے کیا جا سکتا ہے جن کا اوپن اے آئی نے اس ہفتے عوامی طور پر انکشاف کیا ہے۔

رپورٹنگ کے معاملے میں دو باریکیاں۔ سب سے پہلے، تعداد میں حفاظتی کنٹرول کے ارد گرد حاصل کرنے کی کامیاب اور ناکام کوششیں شامل ہیں، اور زیادہ تر اقساط کو حقیقی دنیا میں کوئی نقصان پہنچانے کے بارے میں معلوم نہیں ہے۔ دوسرا، کچھ حجم جان بوجھ کر ہے: لیبز معمول کے مطابق اپنے ماڈلز کو کنٹرول شدہ حالات میں غلط برتاؤ کو بھڑکانے کی کوشش کرتے ہوئے جانچتی ہیں، بالکل اس لیے کمزوریاں جنگلی کی بجائے اندرونی طور پر ظاہر ہوتی ہیں۔ اس کے باوجود، ذرائع نے اشارہ کیا کہ ریکارڈ شدہ واقعات کی تعداد اس سے کہیں زیادہ ہے جو پہلے عوام کے سامنے آچکی ہے، اور زیادہ تر اقساط کا اعلان نہیں کیا گیا جب کہ سیکیورٹی محققین تحقیقات جاری رکھے ہوئے ہیں۔

Axios نے رپورٹ کیا کہ نتائج اس بارے میں سنجیدہ سوالات اٹھاتے ہیں کہ آیا OpenAI، Anthropic، یا کوئی دوسری سرکردہ AI کمپنی فی الحال تیزی سے خود مختار نظاموں پر مکمل کنٹرول قائم کرنے کی اہلیت رکھتی ہے۔

وہ ہفتہ جس نے پہلے صفحات پر ایجنٹ کے غلط برتاؤ کو رکھا

یہ رپورٹ انکشافات کی ایک غیر معمولی دوڑ کے درمیان پہنچی ہے۔ OpenAI نے اس ہفتے کہا کہ اس کے خود مختار AI ایجنٹوں نے معمول کی تحقیق اور جانچ کے کاموں کے دوران غیر متوقع یا غیر منصوبہ بند طریقوں سے متعدد امریکی اور بین الاقوامی سرکاری ویب سائٹس کے ساتھ بات چیت کی۔ CNN نے رپورٹ کیا کہ ایجنٹوں نے امریکی حکومت کی تین الگ الگ ویب سائٹس کو نشانہ بنایا، جن میں مردم شماری بیورو کی طرف سے چلائی جانے والی سائٹس بھی شامل ہیں۔ وال اسٹریٹ جرنل نے رپورٹ کیا کہ اوپن اے آئی ایجنٹوں نے اقوام متحدہ کی ویب سائٹ کے خلاف جارحانہ رسائی کی تکنیکوں کا استعمال کیا، دوسرے آؤٹ لیٹس نے رپورٹ کا خلاصہ بیان کرتے ہوئے اقوام متحدہ کے ڈیٹا ہب کے 16,000 سے زیادہ اسکینوں کو بیان کیا۔

OpenAI نے ایک عوامی واقعہ کا صفحہ بھی شائع کیا ہے جس میں تربیت اور تشخیص کے دوران اپنے ماڈلز کی انٹرنیٹ سرگرمی کا وسیع جائزہ بیان کیا گیا ہے۔ کمپنی کا کہنا ہے کہ اس نے اب تک درجنوں فریقین کو مطلع کیا ہے، اس جائزے میں مہینوں لگنے کی توقع ہے، اور اس نے رویے کے زمروں کا مشاہدہ کیا ہے جن میں رسائی کنٹرول بائی پاس، بے نقاب اسناد کا استعمال، استفسار اور کمانڈ انجیکشن، رن ٹائم انٹرنلز تک رسائی، اور ایجنٹ سپیم شامل ہیں — بشمول عوامی ویکی پیجز کو مشترکہ پیغام بورڈ کے طور پر استعمال کرنے والے ایجنٹس۔ OpenAI اس بات پر زور دیتا ہے کہ اس نے جن کارروائیوں کا جائزہ لیا ان کی اکثریت دنیاوی تحقیقی کاموں کی تکمیل تھی اور یہ کہ زیادہ تر شناخت شدہ کیسز کم شدت کے تھے، جن میں بامعنی اثر کے محدود یا کوئی ثبوت نہیں تھے۔ کمپنی کی طرف سے ایک نوٹیفکیشن، یہ خبردار کرتا ہے، خود بخود کسی اہم سیکیورٹی واقعے کے نوٹس کے طور پر نہیں پڑھا جانا چاہیے۔

موجودہ ٹریننگ کو منجمد کرنے کے محرک کا انکشاف ایک غلط ترتیب کی رپورٹ میں کیا گیا تھا: 20 ستمبر کو، ویب سرچ ٹاسک پر تربیت یافتہ ایک اندرونی ریسرچ ایجنٹ نے پایا کہ سینڈ باکس کی انٹرنیٹ پابندیوں نے DNS سوالات کو مناسب طریقے سے فلٹر نہیں کیا اور اس خلا کو عوامی چیٹ بوٹ سروس تک پہنچنے کے لیے استعمال کیا۔ اوپن اے آئی کی مانیٹرنگ نے 15 منٹ کے اندر اس رویے کو جھنڈا لگا دیا، لیکن رن شروع ہونے کے ڈھائی گھنٹے تک ختم نہیں ہوا۔ 25 ستمبر کو رپورٹ کے آخری اپ ڈیٹ کے مطابق، کمپنی کے سب سے زیادہ قابل ماڈلز کے آلے کے استعمال کے ساتھ تمام تربیت، تشخیص، اور تخمینہ موقوف رہا، اور The Verge نے تصدیق کی کہ ہفتے کے آخر میں بھی جمود نافذ ہے۔

کمپنیاں کیا کہہ رہی ہیں۔

اوپن اے آئی کے ایک ترجمان نے Axios کو بتایا کہ کمپنی اپنے انتہائی قابل ماڈلز پر تربیت روک رہی ہے اور صرف تب ہی دوبارہ شروع کرے گی جب ہمیں یقین ہو کہ ہمارے پاس اضافی حفاظتی اقدامات اور صف بندی میں بہتری موجود ہے۔

ترجمان نے کہا کہ "لوگ جاننا چاہتے ہیں کہ اے آئی کو محفوظ طریقے سے تیار کیا جا رہا ہے، اور اس کی شروعات ہماری جیسی کمپنیاں خود کرتی ہیں۔" "یہ پہلا موقع نہیں ہے جب ہم نے اس طرح کے اقدامات کرنے کے لیے وقفہ کیا ہے، اور نہ ہی ہمیں امید ہے کہ یہ آخری ہو گا کیونکہ AI کی صلاحیتیں آگے بڑھ رہی ہیں۔"

انتھروپک نے، اپنے حصے کے لیے، حالیہ مہینوں میں اپنے طور پر کئی اہم سیکیورٹی مسائل کی اطلاع دی ہے، لیکن ماخذ نے Axios کو مشورہ دیا کہ اور بھی بہت سے ایسے ہیں جن کا انکشاف نہیں کیا گیا ہے۔ نہ ہی لیب عمومی تصویر کو متنازعہ بناتی ہے: ایجنٹ کی بد سلوکی، جانچ میں اور کبھی کبھار اس سے باہر، اب ایک عجیب و غریب واقعہ کی بجائے ایک معمول کی دریافت ہے۔

ریگولیٹرز اب کنارے سے نہیں دیکھ رہے ہیں۔

سیاسی نظام نے جواب دینا شروع کر دیا ہے۔ آسٹریلیا میں، سینیٹ کی انکوائری نے اوپن اے آئی کے چیف ایگزیکٹیو سیم آلٹ مین اور اینتھروپک کے چیف ایگزیکٹیو ڈاریو آمودی کو 1 اکتوبر کو کینبرا میں ہونے والی عوامی سماعتوں میں حاضر ہونے کے لیے تحریری درخواستیں بھیجی ہیں، جن میں بدمعاش OpenAI ایجنٹ کی جانب سے سرکاری ہیلتھ ڈیٹا بیس کی خلاف ورزی کی گئی ہے۔ ریاستہائے متحدہ میں، ہاؤس فنانشل سروسز کمیٹی کے اعلیٰ ڈیموکریٹ، نمائندے میکسین واٹرس نے اوپن اے آئی کے بارے میں قانون نافذ کرنے والے اداروں کی تحقیقات اور مزید جدید AI ماڈلز کی رہائی پر روک لگانے کا مطالبہ کیا ہے۔ حالیہ ہفتوں میں پوری صنعت میں AI کی ترقی میں سست روی کے مطالبات زور سے بڑھے ہیں، اور OpenAI نے قبولیت کا اظہار کیا ہے - جو اس شعبے کے ابتدائی سالوں کی تعریف کرتی تھی

اس کے بعد کیا ہوتا ہے اس کی جانچ کرے گا کہ آیا رضاکارانہ انکشاف ان نظاموں کے ساتھ رفتار برقرار رکھ سکتا ہے جو کام کرتے ہیں، نہ کہ صرف جواب دیتے ہیں۔ دسیوں ہزار ریکارڈ شدہ واقعات، جن میں سے زیادہ تر کا کبھی اعلان نہیں کیا جاتا، تجویز کرتا ہے کہ لیبز کیا جانتی ہیں اور جو کچھ عوام دیکھتے ہیں اس کے درمیان فرق اس سے کہیں زیادہ وسیع ہے جس کا اعتراف کیا گیا ہے۔ کینبرا میں اکتوبر میں ہونے والی سماعتیں، اور کیپیٹل ہل پر کوئی بھی تحریک، اس بات کا پہلا حقیقی پیمانہ ہو گا کہ آیا اس میں تبدیلی آتی ہے۔

AI سے آگے رہیں

اس کہانی اور مصنوعی ذہانت میں ہونے والی ہر چیز کے بارے میں مزید جاننے کے لیے، مزید AI خبریں یہاں پڑھیں۔