علی بابا کی Qwen ریسرچ لیب نے جمعہ کو Qwen 3.8 27B جاری کیا، ایک Apache 2.0-لائسنس یافتہ، وژن کے قابل بڑا لینگویج ماڈل جو کہ ایک معقول مخصوص لیپ ٹاپ پر چلتا ہے - اور، لیب کے اپنے معیارات کے مطابق، نہ صرف اپنے پیشرو سے بہتر کارکردگی کا مظاہرہ کرتا ہے بلکہ حال ہی میں Qwen کے سب سے مضبوط ماڈل کے طور پر سب سے زیادہ وزنی ماڈل تھا۔
ریلیز ڈویلپر حلقوں میں اس مہینے کے سب سے زیادہ زیر بحث ماڈل لانچوں میں سے ایک بن گئی ہے۔ ممتاز آزاد AI محقق اور بلاگر سائمن ولسن کی طرف سے اتوار کو شائع ہونے والا ایک ہینڈ آن جائزہ سینکڑوں اپ ووٹوں کے ساتھ ہیکر نیوز کے صفحہ اول پر پہنچا، قارئین اس ماڈل کی صلاحیتوں اور اس کی غیر معمولی ڈیفالٹ ترتیب پر بحث کر رہے ہیں۔ For more context on this story, see our ongoing latest AI developments.
Qwen 3.8 27B میں نیا کیا ہے۔
یہ ماڈل علی بابا کی اوپن ویٹ لائن میں تازہ ترین ہے، جو کہ بہت بڑے Qwen 3.8 2.4T-A95B مکسچر آف ایکسپرٹس کی ریلیز کے ہفتوں بعد پہنچ رہا ہے۔ Qwen کے خود رپورٹ کردہ بینچ مارکس کے مطابق، 27B ماڈل Qwen 3.6 27B اور کلوز ویٹ Qwen 3.7-Plus دونوں پر فوائد دکھاتا ہے - ایک ایسا ماڈل جو اپنے نام کے باوجود، اس سال کے شروع میں Qwen کے کسی بھی سائز کے مضبوط ترین اداکاروں میں سے ایک تھا۔
ماڈل 262,144 ٹوکنز کی زیادہ سے زیادہ سیاق و سباق کی لمبائی کو سپورٹ کرتا ہے، وژن ان پٹ کو ہینڈل کرتا ہے، اور ایک `Reasoning_effort` پیرامیٹر کے لیے آفیشل سپورٹ کے ساتھ جہاز جو تین سطحوں پر استدلال کی گہرائی کو ایڈجسٹ کرتا ہے: `xhigh`، `Medium` اور `low`۔
یہ وہ پہلی ترتیب ہے — `xhigh`، فیکٹری ڈیفالٹ — جو ریلیز کا بات کرنے کا مقام بن گیا ہے۔
زیادہ سوچنے کا مسئلہ
ولسن، جس نے LM اسٹوڈیو کی 17GB Q4_K_M کوانٹائزڈ بلڈ کا استعمال کرتے ہوئے 128GB MacBook Pro اور NVIDIA DGX Spark پر ماڈل کا تجربہ کیا، نے پہلے سے طے شدہ کو "شاندار حد سے زیادہ سوچ" پیدا کرنے کے طور پر بیان کیا۔
ایک شاندار مثال میں، اس نے ماڈل سے کہا کہ وہ سائیکل پر سوار پیلیکن کا SVG کھینچے۔ پہلے سے طے شدہ `xhigh` استدلال کی کوشش کے ساتھ، ماڈل نے آؤٹ پٹ کے 3,223 ٹوکن پیدا کرنے کے لیے 22,276 استدلال کے ٹوکن خرچ کیے — ایک ایسا عمل جس میں اس کے ہارڈ ویئر پر 21 منٹ لگے۔ نتیجہ، اس نے نوٹ کیا، "اب تک کا بہترین پیلیکن SVG" تھا جو وہ ایک ایسے ماڈل کے ساتھ پیدا کرنے میں کامیاب رہا ہے جو مقامی طور پر چلتا ہے، صحیح بائیسکل جیومیٹری، فریم کے دونوں طرف ٹانگیں اور ایک ذائقہ دار تصویری پس منظر۔
ٹریڈ آف واضح ہے: 21 منٹ زیادہ تر کاموں کے لیے ایک ناقابل عمل انتظار ہے۔ اسی پرامپٹ کو استدلال کو غیر فعال کرنے کے ساتھ دوبارہ چلانے سے 137 سیکنڈ میں جواب پیدا ہوا — وقت کے دسویں حصے سے کم — اسی طرح کی آؤٹ پٹ لمبائی پر۔
یہاں تک کہ معمولی سادہ اشارے بھی رویے کو متحرک کرتے ہیں۔ "ایک دائرے کا ایک svg کھینچنے" کے لیے کہا گیا، ماڈل کا استدلال ٹریس پیلیٹ آپشنز، بوہاؤس اسٹائلنگ، پرتوں والی انگوٹھیاں اور اینیمیشن اپروچز کے ذریعے کھولا گیا — ایک ایسی شکل کے لیے کئی منٹوں پر غور کیا گیا جس کے لیے ایک XML ٹیگ کی ضرورت ہوتی ہے۔
ولیسن کا فیصلہ: ماڈل بہترین ہے، لیکن ڈیفالٹ کنفیگریشن "ماڈل کو چلانے کا بالکل اچھا طریقہ نہیں ہے، خاص طور پر صارفین کے ہارڈ ویئر پر۔" صارفین `میڈیم` یا `کم` استدلال کی کوشش پر سوئچ کر سکتے ہیں، یا توسیعی سوچ کو مکمل طور پر غیر فعال کر سکتے ہیں۔
مقامی AI کی رفتار
ریلیز اس بات کی نشاندہی کرتی ہے کہ فرنٹیئر کلاؤڈ ماڈلز اور مقامی طور پر چلنے کے قابل اوپن ماڈلز کے درمیان صلاحیتوں کا فرق کتنی تیزی سے کم ہو گیا ہے۔ ایک 17 جی بی فائل جو لیپ ٹاپ پر چلتی ہے اب وہ نتائج پیدا کرتی ہے جو، مخصوص تخلیقی کاموں میں، ڈیٹا سینٹر اسکیل کے ماڈلز کی ضرورت کے مقابلے میں کچھ عرصہ پہلے نہیں تھے۔
یہ چینی لیبز سے کھلے وزن کی رفتار کو بھی جاری رکھے ہوئے ہے جس نے 2026 کی تعریف کی ہے۔ علی بابا کا کیوین فیملی اس سال عالمی سطح پر سب سے زیادہ ڈاؤن لوڈ کی جانے والی ماڈل لائنوں میں شامل ہے، جو ڈویلپر کے ذہن کے اشتراک کے لیے Meta، DeepSeek اور Moonshot AI کی ریلیز کے ساتھ مقابلہ کرتی ہے۔ Qwen 3.8 27B کے لیے آزاد بینچ مارک کے نتائج اب بھی جمع ہو رہے ہیں، اور ولسن نے واضح طور پر خبردار کیا ہے کہ لیب کے خود رپورٹ کردہ نمبر تیسرے فریق کی تصدیق کے منتظر ہیں۔
صارفین کے لیے عملی رہنمائی
ماڈل پر غور کرنے والے ڈویلپرز اور شائقین کے لیے، ابتدائی جانچ سے ابھرتی ہوئی اتفاق رائے سیدھا سیدھا ہے: Qwen 3.8 27B مقامی AI کام کے بوجھ کے لیے ایک مضبوط ڈیفالٹ انتخاب ہے جس میں وژن یا طویل دستاویزات شامل ہیں، لیکن استدلال کی کوشش کو اس کام کے مطابق کیا جانا چاہیے۔ پیچیدہ تجزیہ `xhigh` کا جواز پیش کر سکتا ہے۔ روزمرہ کے سوالات اور فوری مسودے `میڈیم` یا اس سے نیچے میں تیز اور سستے ہیں۔
ایل ایم اسٹوڈیو جیسے ٹولز کے ذریعے ماڈل چلانے والے صارفین کو بھی 8,192 ٹوکنز سے ڈیفالٹ سیاق و سباق کی ونڈو کو بڑھانا چاہیے — ولسن کو معلوم ہوا کہ ماڈل کی توسیعی سوچ نے بجٹ کو مکمل 262,144 ٹوکن سیاق و سباق کے ساتھ لوڈ کرنے سے پہلے ہی دنیا بھر کے مسائل پر بھی ختم کر دیا ہے۔
سب سے بڑا سوال یہ ہے کہ اوپن ماڈل ریس کے اگلے مرحلے کے بارے میں ریلیز کیا اشارہ کرتی ہے: چونکہ استدلال کے طرز کے ماڈل معمول بن گئے ہیں، کنفیگریشن ڈیفالٹس حقیقی استعمال کے نتائج کے ساتھ پروڈکٹ کے فیصلوں میں بدل رہے ہیں — اور Qwen کا `xhigh` ڈیفالٹ پہلے سے ہی سب سے زیادہ زیر بحث مثال ہے۔
کھلے وزن کے لیے ایک سنگ میل
یہ ریلیز ایک سنگ میل کی نشاندہی کرتی ہے جس میں اوپن ویٹ لیبز اب چھوٹے پیمانے پر فراہم کر سکتی ہیں۔ وژن کی صلاحیت، ایک 262,144 ٹوکن سیاق و سباق کی ونڈو اور ایک پیکیج میں مسابقتی استدلال کی کارکردگی جو صارفین کے لیپ ٹاپ پر فٹ بیٹھتی ہے، دو سال پہلے Apache-2.0-لائسنس یافتہ ماڈل میں ناقابل تصور ہوتا۔ مقامی-پہلی ایپلی کیشنز بنانے والے ڈویلپرز کے لیے — جہاں ڈیٹا کی رازداری، تاخیر یا آف لائن آپریشن کلاؤڈ APIs کو مسترد کرتے ہیں — عملی اختیارات تیزی سے بہتر ہوتے رہتے ہیں۔
ولسن کی جانچ ماحولیاتی نظام کے لیے ایک پختگی کے نقطہ کو بھی نمایاں کرتی ہے: مقامی ماڈلز کے ارد گرد ٹولنگ، LM اسٹوڈیو کے ایک کلک GGUF ڈاؤن لوڈز سے لے کر قابل استدلال پیرامیٹرز تک، اس حد تک ترقی کر چکی ہے کہ ماڈل کی سوچ کی گہرائی کو ٹیوننگ کرنا اب تحقیقی مشق کے بجائے صارف کا معمول کا فیصلہ ہے۔ جیسے جیسے آنے والے دنوں میں آزاد معیارات جمع ہوتے جائیں گے، اس کی تصویر بالکل واضح ہو جائے گی کہ Qwen 3.8 27B اپنے کھلے اور بند حریفوں کے خلاف کہاں اترتا ہے — لیکن ابتدائی استقبال اس لائن میں ایک اور مضبوط اندراج کی تجویز کرتا ہے جس نے Alibaba کو دنیا کے سب سے زیادہ نتیجہ خیز اوپن ماڈل پبلشرز میں سے ایک بنا دیا ہے۔
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →