بینچ مارکنگ پلیٹ فارم ایرینا کے نئے تجزیے کے مطابق، اینتھروپک کے کلاڈ اوپس 5.5 نے ایم ڈیش کو چھوڑ دیا ہے، جو کہ AI سے تیار کردہ ٹیکسٹ کے سب سے زیادہ قابل شناخت ٹکس میں سے ایک ہے۔ ماڈل اب اپنے پیشرو کے مقابلے میں تقریباً 95 فیصد کم ایم ڈیشز کا استعمال کرتا ہے، چھوٹے جملوں میں لکھتا ہے، اور آسان الفاظ کی حمایت کرتا ہے۔ ایک قابل ذکر تجارت ہے: اس کے جوابات طویل ہوتے جا رہے ہیں۔
یہ نتائج ارینا کے اگست اور ستمبر 2026 کے درمیان ٹیکسٹ ایرینا کے ذریعے جمع کیے گئے اعلیٰ استدلال والے جوابات کے تجزیے سے سامنے آئے ہیں، جیسا کہ بلیپنگ کمپیوٹر نے رپورٹ کیا ہے۔ ایرینا کو ٹریک کرنے والے بارہ تحریری اقدامات میں سے، دس اس طرف چلے گئے جسے پلیٹ فارم کلاڈ اوپس 5 کے مقابلے میں ایک بہتر سمت سمجھتا ہے۔ For more context on this story, see our ongoing AI news.
کلاڈ کے انداز کی تبدیلی کے پیچھے نمبر
ہیڈ لائن کے اعدادوشمار ایم ڈیش کا خاتمہ ہے۔ Opus 5 نے فی 1,000 الفاظ میں 15.2 ایم ڈیشز کا استعمال کیا، جبکہ Opus 5.5 نے اس اعداد و شمار کو صرف 0.8 تک گرا دیا، ارینا کے اعداد و شمار کے مطابق، تقریباً 95 فیصد کی کمی۔
سیمیکولنز، ایک اور اوقاف کی عادت جسے اکثر مشین کی طرح جھنڈا لگایا جاتا ہے، بھی تیزی سے گرا، 6.10 سے 1.64 فی 1,000 الفاظ پر۔ رموز اوقاف کے ساتھ ساتھ جملے کا ڈھانچہ بھی بدل گیا: Opus 5.5 کے جوابات میں اوسط جملہ اب 10.03 الفاظ پر چلتا ہے، Opus 5 کے لیے 12.14 الفاظ سے کم، تجزیہ کے ساتھ آسان الفاظ کے انتخاب اور لمبے، شقوں کے ڈھیر والے جملوں میں سے کم کو بھی نوٹ کیا گیا جو پہلے ماڈلز کے دستخط بن گئے۔
ایرینا کے ڈیٹاسیٹ نے دو ماہ کی ونڈو میں ٹیکسٹ ایرینا کے اعلیٰ استدلال والے جوابات پر توجہ مرکوز کی، جس کا مطلب ہے کہ موازنہ کا دائرہ روزمرہ کے استعمال کے بجائے ایک مخصوص تشخیصی ترتیب تک ہے۔ اس کے باوجود، تبدیلی کی سمت پلیٹ فارم کے ٹریک کردہ زیادہ تر اقدامات میں یکساں ہے۔
ایم ڈیش AI کا کالنگ کارڈ کیوں بن گیا۔
ایم ڈیش نے AI تحریری ثقافت میں ایک عجیب مقام حاصل کیا۔ برسوں سے، قارئین، ایڈیٹرز، اور خود ساختہ AI ڈیٹیکٹرز کی طرف سے ایم ڈیشوں کے گھنے بکھرنے کا سلوک مشین سے تیار کردہ نثر کی ایک اہم علامت کے طور پر کیا گیا، یہاں تک کہ اوقاف کا نشان کم معیار، مشین سے تیار کردہ مواد کے وسیع تر رجحان کے لیے شارٹ ہینڈ بن گیا، جسے اکثر AI کے طور پر مسترد کر دیا جاتا ہے۔
آیا دقیانوسی تصور کبھی ایک قابل اعتماد سگنل تھا اس پر بحث کی جاسکتی ہے، کیونکہ بہت سارے انسانی مصنفین آزادانہ طور پر ایم ڈیشز کا استعمال کرتے ہیں اور بہت سے AI متن ان سے گریز کرتے ہیں۔ لیکن یہ تاثر اہمیت رکھتا ہے، خاص طور پر ان کاروباروں کے لیے جو مارکیٹنگ کی کاپی، دستاویزات، اور مضامین کا مسودہ تیار کرنے کے لیے بڑے زبان کے ماڈل استعمال کرتے ہیں اور نہیں چاہتے کہ ان کا آؤٹ پٹ واضح طور پر مصنوعی طور پر پڑھے۔
اس پس منظر میں، ایک ماڈل جو ظاہری طور پر پیٹرن سے اجتناب کرتا ہے، اس کی فروخت کا ایک عملی نقطہ ہے۔ جیسا کہ BleepingComputer نے اپنی رپورٹ میں مشاہدہ کیا، Opus 5.5 کے واضح AI تحریری نمونوں پر انحصار کم ہونے کا مطلب ہے کہ صارفین کا متن تیار کرنے کا امکان کم ہے جو کہ عام مشین آؤٹ پٹ کے طور پر پڑھتا ہے۔
تجارت بند: چھوٹے جملے، طویل جوابات
ایک پیمانہ جس نے غلط طریقے سے آگے بڑھایا وہ لفظی ہے۔ ایرینا کے نمبروں کے مطابق، Opus 5.5 کے لیے اوسط جواب کی لمبائی Opus 5 کے مقابلے میں 453 الفاظ سے بڑھ کر 481 الفاظ تک پہنچ گئی، جس سے یہ مقابلے میں سب سے طویل تحریر والا Opus ماڈل بن گیا۔
یہ ایک چھوٹی سی اضافہ کی طرح لگ سکتا ہے، لیکن یہ ٹرسر، زیادہ براہ راست ماڈل آؤٹ پٹس کی طرف وسیع تر صنعت کے رجحان کے خلاف ہے، اور اس کا مطلب ہے کہ API کالز پر ٹوکن جلانے والے صارفین اسی چیز کے لیے قدرے زیادہ ادائیگی کر سکتے ہیں۔ لمبے جوابات کے ساتھ مل کر چھوٹے چھوٹے جملے بھی ان میں سے زیادہ کو ظاہر کرتے ہیں: ماڈل اپنے نثر کو چھوٹے ٹکڑوں میں توڑ رہا ہے جبکہ مجموعی طور پر زیادہ بول رہا ہے۔
لفظیات، یقیناً، خود بخود کوئی خامی نہیں ہے۔ وضاحت، دستاویزات، اور تجزیہ جیسے کاموں کے لیے، چند اضافی جملے وضاحت کا اضافہ کر سکتے ہیں۔ فوری جوابات یا لاگت سے متعلق کام کے بوجھ کے لیے، یہ دیکھنے کے قابل رجحان ہے۔
مصنفین، ایڈیٹرز، اور ڈیٹیکشن ٹولز کے لیے اس کا کیا مطلب ہے۔
تجزیہ ایک یاد دہانی ہے کہ AI متن کے شماریاتی فنگر پرنٹس حرکت پذیر اہداف ہیں۔ ایم ڈیشز، سیمیکولن عادات، یا جملے کی طوالت کو جھنڈا لگانے کے لیے بنائے گئے ٹولز اور ہیورسٹکس انحطاط پذیر ہوں گے کیونکہ لیبز ان نمونوں کو جان بوجھ کر ٹیون کرتی ہیں، چاہے پڑھنے کی اہلیت کو بہتر بنایا جائے یا محض ان سے جڑے بدنما داغ سے بچنے کے لیے۔
یہ اس بات کی بھی نشاندہی کرتا ہے کہ فرنٹیئر ماڈلز کے درمیان مقابلہ ان خصوصیات کی طرف بڑھ گیا ہے جن کو روایتی معیارات میں حاصل کرنا مشکل ہے۔ ایرینا کے اعداد و شمار سے پتہ چلتا ہے کہ انتھروپک اس بات پر توجہ دے رہا ہے کہ اس کا ماڈل کس طرح لکھتا ہے، نہ کہ یہ کس طرح کوڈ کرتا ہے۔ BleepingComputer نوٹ کرتا ہے کہ Opus 5.5 کو کوڈنگ کے لیے سب سے مضبوط ماڈلز میں سے ایک سمجھا جاتا ہے، اور تحریری معیار ایک ایسی مارکیٹ میں ایک پرسکون تفریق بن گیا ہے جہاں زیادہ تر عوامی موازنہ ایجنٹ اور پروگرامنگ کی تشخیص کے گرد گھومتے ہیں۔
مرئی نقش کے ساتھ ایک چھوٹی سی تبدیلی
کوئی بھی بینچ مارک ٹیبل نہیں پڑھتا اور اپنا نثر تبدیل نہیں کرتا۔ لیکن متن کے اس بہت بڑے حجم میں کئی گنا اضافہ کیا گیا جو اب بڑے زبان کے ماڈلز روزانہ تیار کرتے ہیں، ایم ڈیش کے استعمال میں 95 فیصد کمی اس قسم کی تبدیلی ہے جو جنگل میں نظر آتی ہے، جیسا کہ رپورٹ میں کہا گیا ہے، انٹرنیٹ پر ایم ڈیشز کم اور کم ہیں۔
ابھی کے لیے، ٹیک وے سیدھے ہیں۔ Claude Opus 5.5 AI سے تیار کردہ متن سے وابستہ اوقاف کی کم عادات کے ساتھ لکھتا ہے، جملوں کو چھوٹا رکھتا ہے، اور اپنے پیشرو سے زیادہ آسان الفاظ استعمال کرتا ہے۔ یہ بھی کچھ زیادہ بولتا ہے۔ آیا یہ امتزاج بہتر پڑھتا ہے انفرادی صارفین کے لیے ایک فیصلہ ہے، لیکن یہ لیبز کی ایک ٹھوس، قابل پیمائش مثال ہے جو مشین کی تحریر کی طرح کی آواز کو فعال طور پر نئی شکل دیتی ہے۔
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →