AI ٹیوشن کے حقیقی دنیا کے سب سے زیادہ مہتواکانکشی ٹیسٹوں میں سے ایک نے ایک سنجیدہ فیصلہ دیا ہے۔ ٹینیسی کے 18 مڈل اسکولوں میں خان اکیڈمی کے خانمیگو ٹیوٹر کے دو سالہ کلسٹر کے بے ترتیب ٹرائل نے پایا کہ AI ٹیوٹر تک رسائی نے قابل پیمائش لیکن معمولی ریاضی کے فوائد حاصل کیے، اور یہ کہ نتائج کو اس مسئلے کی وجہ سے روک دیا گیا جس کی تکنیکی ماہرین شاذ و نادر ہی تشہیر کرتے ہیں: زیادہ تر طلباء نے بمشکل اس کا استعمال کیا۔ یہ مطالعہ، جس کا عنوان ہے "ایک کلک دور: اے آئی ٹیوشن ود خانمیگو کے ساتھ دو سالہ اسکول کے تجربے میں،" فلپ اوریوپولوس اور نینا لو نے کروایا تھا اور براؤن یونیورسٹی کے ایڈ ورکنگ پیپرز سیریز میں ایننبرگ انسٹی ٹیوٹ کے ذریعے شائع کیا گیا تھا۔

نتائج کسی ایک پروڈکٹ سے زیادہ اہمیت رکھتے ہیں، کیونکہ خانمیگو امریکی اسکولوں میں سب سے زیادہ تعینات کیے جانے والے AI ٹیوٹرز میں سے ایک ہے اور یہ مطالعہ کلاس روم کے عام حالات میں جنریٹو AI ٹیوشن کے پہلے بڑے پیمانے پر تجرباتی جائزوں میں سے ایک ہے۔ AI ریسرچ نیوز اور حقیقی دنیا کے اداروں کے ساتھ اس کے ٹکراؤ سے باخبر رہنے والے ہر شخص کے لیے، یہ مقالہ مارکیٹنگ کے دعووں پر غلبہ والی بحث میں سخت شواہد کا ایک نادر ٹکڑا ہے، اور یہ اس ہفتے ہیکر نیوز کے صفحہ اول پر اترا جب ماہرین تعلیم اور تکنیکی ماہرین نے اس کے مضمرات کو پارس کیا۔

مطالعہ سے کیا ملا

ٹرائل نے 18 ٹینیسی مڈل اسکولوں کے طلباء کو تصادفی طور پر موجودہ روزانہ علاجی ریاضی کے سیشنوں کے دوران خان اکیڈمی کو اپنے AI ٹیوٹر خانمیگو کے ساتھ استعمال کرنے کے لیے تفویض کیا۔ اہم بات یہ ہے کہ ٹیوٹر کو جوابات دینے کے بجائے کوچ کرنے کے لیے ترتیب دیا گیا تھا، جو خان ​​اکیڈمی کے بیان کردہ درس گاہ کی عکاسی کرتا ہے۔ یہ تجربہ دو اسکولی سالوں تک جاری رہا، جس سے یہ AI ٹیوشن پر اب تک کے سب سے طویل فیلڈ تجربات میں سے ایک ہے۔

سرخی کے نتائج: AI ٹیوشن کنڈیشن کی تفویض نے ریاضی کی کامیابی کو 1.3 قومی پرسنٹائل رینک فی ٹرم تک بڑھایا، جسے مصنفین ایک تعلیمی سال کے دوران تقریباً 0.06 سے 0.08 معیاری انحراف کے حساب سے شمار کرتے ہیں۔ فعال شرکت کے پورے سال کا مضمر اثر 0.14 معیاری انحراف تک پہنچ جاتا ہے۔ یہ حقیقی، شماریاتی طور پر قابل شناخت فوائد ہیں، اور کم لاگت والے سافٹ ویئر کی مداخلت کے لیے وہ قابل احترام ہیں۔

لیکن وہ موازنہ جو ہائپ کو خراب کرتا ہے وہ یہ ہے: حاصلات AI کی مدد کے بغیر خان اکیڈمی کی پریکٹس سے ملتی جلتی ہیں۔ وہ طلبا جنہوں نے پلیٹ فارم کے موجودہ پریکٹس ٹولز کا استعمال کیا، جن میں کوئی AI ٹیوٹر منسلک نہیں تھا، ایسا لگتا ہے کہ خانمیگو تک رسائی حاصل کرنے والے طالب علموں نے بھی کیا ہے۔

ڈیٹا میں مشغولیت کا مسئلہ

کاغذ کا سب سے زیادہ انکشاف کرنے والا حصہ اس کے استعمال کا فرانزک اکاؤنٹ ہے۔ سطح پر، گود لینا مضبوط نظر آتا ہے: 96 فیصد طلباء نے خانمیگو کو کم از کم ایک بار آزمایا۔ نیچے، منگنی ٹوٹ جاتی ہے۔ میڈین طالب علم نے ٹیوٹر کو صرف ایک تہائی دنوں میں میسج کیا جن میں انہوں نے ریاضی کی مشق کی، اور صرف 17 فیصد ورزش کے سیشنوں میں جن میں انہوں نے غلطی کی تھی۔ جب طلباء نے ٹیوٹر کو میسج کیا تو مصنفین کو معلوم ہوا کہ پیغامات زیادہ تر خالی جوابات تھے یا تجویز کردہ اشارے پر کلک کرتے تھے، بجائے اس کے کہ ریاضیاتی مکالمے کے۔

دوسرے لفظوں میں، ٹیوٹر کو غلطیوں کے ذریعے سقراطی طور پر طلباء کو کوچ کرنے کے لیے ترتیب دیا گیا تھا، لیکن طلباء زیادہ تر کوچنگ گفتگو سے مکمل طور پر گریز کرتے تھے۔ مصنفین نے یہ نتیجہ اخذ کیا کہ پابند رکاوٹ مصروفیت دکھائی دیتی ہے: AI ٹیوشن کے وعدے کو محسوس کرنے کے لیے طلباء کو صرف رسائی دینے کی بجائے اسے استعمال کرنے کی ضرورت ہوگی۔

یہ AI خریدنے والے اسکولوں کے لیے کیوں اہم ہے۔

ریاستہائے متحدہ کے اضلاع پر AI ٹولز کو اپنانے کے لیے دباؤ ہے، اور تقریباً ہر پچ میں ٹیوشن کا استعمال سب سے اہم ہے۔ جنریٹو اے آئی کو ایک ایسی ٹیکنالوجی کے طور پر فروغ دیا گیا ہے جو آخر کار اسے فراہم کر سکتی ہے جسے تعلیمی محققین دو سگما خواب کہتے ہیں: ہر طالب علم کے لیے ایک ذاتی ٹیوٹر۔ بلوم کی دو سگما فریمنگ انسانی ٹیوشن پر پرانی تحقیق سے آتی ہے، اور یہ بالکل وہی وعدہ ہے جس کے خلاف AI ٹیوٹرز کی مارکیٹنگ کی جاتی ہے۔

یہ مطالعہ بتاتا ہے کہ رکاوٹ ماڈل کا معیار یا رسائی نہیں ہے۔ علاج کرنے والے گروپ کے ہر طالب علم کے پاس اپنے روزانہ ریاضی کے بلاک کے اندر ایک کلک کی دوری پر ایک جدید ترین LLM ٹیوٹر موجود تھا۔ رکاوٹ یہ تھی کہ آیا نوعمر رضاکارانہ طور پر علاجی کلاس میں دن بہ دن ٹیوشن ڈائیلاگ کو برقرار رکھیں گے۔ انسانی ٹیوشن جزوی طور پر کام کرتی ہے کیونکہ جب آپ منقطع ہو جاتے ہیں تو ایک شخص نوٹس لیتا ہے۔ سافٹ ویئر، اب تک، اس پل کو قابل اعتماد طریقے سے نقل نہیں کرتا ہے۔

ذہن میں رکھنے کے قابل انتباہات

یہ مقالہ ایک EdWorkingPaper ہے، جسے براؤن یونیورسٹی کے ایننبرگ انسٹی ٹیوٹ کے ذریعے تقسیم کیا گیا ہے، اور قارئین کو اسے ہم مرتبہ کے جائزے کے نتائج کے بجائے کام کرنے والی تحقیق کے طور پر سمجھنا چاہیے۔ مطالعہ ایک ریاست میں مڈل اسکول کے علاج کے ریاضی کا احاطہ کرتا ہے، لہذا دوسرے مضامین، گریڈ کی سطح، یا نفاذ کے ماڈلز کو عام کرنا قیاس آرائی پر مبنی ہے۔ مصنفین کی اپنی فریمنگ کی پیمائش کی جاتی ہے: وہ رپورٹ کرتے ہیں کہ کیا ہوا جب ایک وسیع پیمانے پر دستیاب AI ٹیوٹر کو موجودہ پریکٹس سیشنز میں پرت دیا گیا، نہ کہ مختلف نصاب یا مشغولیت کے لیے مضبوط ترغیبات کے تحت کیا ہو سکتا ہے۔

یہ بات بھی قابل غور ہے کہ مطالعہ کیا نہیں کہتا۔ یہ نہیں ملتا کہ AI ٹیوشن بیکار ہے؛ فعال شرکت کے پورے سال سے 0.14 معیاری انحراف کا اثر بامعنی ہوگا اگر مصروفیت برقرار رہ سکے۔ تلاش اس کے قریب تر ہے: ٹیکنالوجی نے کام کیا اور ساتھ ہی ساتھ غیر AI پریکٹس ٹولز کے بارے میں بھی اسے بولٹ کیا گیا، کیونکہ طلباء نے AI کو ان بٹنوں سے مختلف طریقے سے استعمال نہیں کیا جنہیں وہ پہلے ہی نظر انداز کر چکے تھے۔

ٹیک وے

تعلیمی ٹیکنالوجی کے شعبے نے یہ وعدہ کرتے ہوئے دو سال گزارے ہیں کہ تخلیقی AI ٹیوٹرز کلاس رومز کو تبدیل کر دیں گے۔ یہ آزمائش، پورے دو سالوں میں حقیقی طالب علموں کی پیروی کرنے والے اولین میں سے ایک، تجویز کرتی ہے کہ تبدیلی کو ایک قدیم مسئلہ کی طرف اشارہ کیا گیا ہے: بچوں کو کام کرنے کی خواہش دلانا۔ اسکول کے رہنماؤں کے لیے، سبق یہ ہے کہ AI وینڈرز سے صرف لائسنس کی تعداد ہی نہیں، مصروفیت کے ڈیٹا کا مطالبہ کریں۔ AI صنعت کے لیے، یہ ایک یاد دہانی ہے کہ AI کی تعیناتی میں سب سے مشکل مسائل ماڈل کے بارے میں شاذ و نادر ہی ہوتے ہیں۔

اے آئی ریسرچ کے ساتھ جاری رکھیں

اس طرح کے فیلڈ تجربات کسی بھی بینچ مارک سے زیادہ تیزی سے ہائپ سائیکل کو کاٹتے ہیں۔ حقیقی دنیا کے نتائج کے ساتھ AI تحقیق کی مسلسل کوریج کے لیے، aibuzzwire.news پر AI خبروں کی پیروی کریں۔

مزید AI خبریں پڑھیں →