আলিবাবার Qwen গবেষণা ল্যাব শুক্রবার Qwen 3.8 27B প্রকাশ করেছে, একটি Apache 2.0-লাইসেন্সযুক্ত, দৃষ্টি-সক্ষম বৃহৎ ভাষা মডেল যা একটি যুক্তিসঙ্গতভাবে নির্দিষ্ট ল্যাপটপে চলে — এবং, ল্যাবের নিজস্ব বেঞ্চমার্ক অনুসারে, এটি কেবল তার পূর্বসূরিকে ছাড়িয়ে যায় না কিন্তু সম্প্রতি কিউয়েন মডেলের মধ্যে সবচেয়ে শক্তিশালী ছিল যা মে'র মতো শক্তিশালী।

রিলিজটি বিকাশকারী চেনাশোনাগুলিতে এই মাসের সবচেয়ে আলোচিত মডেল লঞ্চগুলির মধ্যে একটি হয়ে উঠেছে৷ বিশিষ্ট স্বাধীন এআই গবেষক এবং ব্লগার সাইমন উইলিসন দ্বারা রবিবার প্রকাশিত একটি হ্যান্ডস-অন রিভিউ, শত শত আপভোট সহ হ্যাকার নিউজের প্রথম পৃষ্ঠায় পৌঁছেছে, পাঠকরা মডেলের ক্ষমতা এবং এর অস্বাভাবিক ডিফল্ট কনফিগারেশন নিয়ে বিতর্ক করছেন। For more context on this story, see our ongoing more AI stories.

Qwen 3.8 27B-এ নতুন কি আছে

মডেলটি আলিবাবার ওপেন-ওয়েট লাইনের সর্বশেষতম, যা অনেক বড় Qwen 3.8 2.4T-A95B মিশ্রণ-অফ-বিশেষজ্ঞদের প্রকাশের কয়েক সপ্তাহ পরে এসেছে। Qwen-এর স্ব-প্রতিবেদিত বেঞ্চমার্ক অনুসারে, 27B মডেলটি Qwen 3.6 27B এবং ক্লোজড-ওয়েট Qwen 3.7-প্লাস উভয়ের উপরেই লাভ দেখায় — একটি মডেল যেটির নাম থাকা সত্ত্বেও, এই বছরের শুরুর দিকে যে কোনো আকারের Qwen-এর অন্যতম শক্তিশালী পারফর্মার ছিল।

মডেলটি সর্বাধিক প্রসঙ্গ দৈর্ঘ্য 262,144 টোকেন সমর্থন করে, দৃষ্টি ইনপুট পরিচালনা করে এবং একটি `রিজনিং_এফোর্ট` প্যারামিটারের জন্য অফিসিয়াল সমর্থন সহ জাহাজ যা তিনটি স্তরে যুক্তির গভীরতা সামঞ্জস্য করে: `xhigh`, `মাঝারি` এবং `নিম্ন`।

এটি সেই প্রথম সেটিং — `xhigh`, ফ্যাক্টরি ডিফল্ট — যা রিলিজের আলোচনার পয়েন্ট হয়ে উঠেছে।

অতিরিক্ত চিন্তার সমস্যা

উইলিসন, যিনি LM স্টুডিওর 17GB Q4_K_M কোয়ান্টাইজড বিল্ড ব্যবহার করে একটি 128GB ম্যাকবুক প্রো এবং একটি NVIDIA DGX স্পার্ক-এ মডেলটি পরীক্ষা করেছিলেন, ডিফল্টটিকে "দর্শনীয় ওভার-থিঙ্কিং" উত্পাদন হিসাবে বর্ণনা করেছেন।

একটি আকর্ষণীয় উদাহরণে, তিনি মডেলটিকে সাইকেল চালানো একটি পেলিকানের একটি SVG আঁকতে বলেছিলেন। ডিফল্ট `xhigh` যুক্তির প্রচেষ্টার সাথে, মডেলটি 22,276 টি যুক্তির টোকেন ব্যয় করেছে 3,223 টোকেন আউটপুট তৈরি করতে - একটি প্রক্রিয়া যা তার হার্ডওয়্যারে 21 মিনিট সময় নেয়। ফলাফল, তিনি উল্লেখ করেছেন, "এখন পর্যন্ত সেরা পেলিকান SVG" তিনি একটি মডেল তৈরি করতে সক্ষম হয়েছেন যা স্থানীয়ভাবে চলে, সঠিক সাইকেল জ্যামিতি, ফ্রেমের উভয় পাশে পা এবং একটি সুস্বাদু চিত্রিত পটভূমি।

ট্রেড-অফ স্পষ্ট: 21 মিনিট বেশিরভাগ কাজের জন্য একটি অবাস্তব অপেক্ষা। যুক্তি অক্ষম করে একই প্রম্পট পুনরায় চালানোর ফলে 137 সেকেন্ডের মধ্যে একটি প্রতিক্রিয়া তৈরি হয়েছিল — সময়ের এক-দশমাংশের নিচে — একই আউটপুট দৈর্ঘ্যে।

এমনকি তুচ্ছ সাধারণ প্রম্পটগুলি আচরণকে ট্রিগার করে। "একটি বৃত্তের একটি svg আঁকতে" বলা হলে প্যালেট বিকল্প, বাউহাউস স্টাইলিং, স্তরযুক্ত রিং এবং অ্যানিমেশন পদ্ধতির ওজনের মাধ্যমে মডেলের যুক্তির চিহ্ন খোলা হয়েছে — একটি আকৃতির জন্য কয়েক মিনিটের আলোচনা যার জন্য একটি একক XML ট্যাগ প্রয়োজন৷

উইলিসনের রায়: মডেলটি চমৎকার, কিন্তু ডিফল্ট কনফিগারেশনটি "মডেল চালানোর জন্য একেবারেই ভালো উপায় নয়, বিশেষ করে ভোক্তা হার্ডওয়্যারে।" ব্যবহারকারীরা `মাঝারি` বা `নিম্ন` যুক্তির প্রচেষ্টায় স্যুইচ করতে পারেন, বা সম্প্রসারিত চিন্তা সম্পূর্ণরূপে অক্ষম করতে পারেন।

স্থানীয় AI এর মোমেন্টাম

রিলিজটি স্পষ্ট করে যে ফ্রন্টিয়ার ক্লাউড মডেল এবং স্থানীয়ভাবে চালানো যায় এমন উন্মুক্ত মডেলগুলির মধ্যে ক্ষমতার ব্যবধান কত দ্রুত সংকুচিত হয়েছে। একটি 17GB ফাইল যা একটি ল্যাপটপে চালিত হয় তা এখন এমন ফলাফল তৈরি করে যা নির্দিষ্ট সৃজনশীল কাজে, ডেটা-সেন্টার-স্কেল মডেলগুলির প্রতিদ্বন্দ্বী যা খুব বেশি আগে নয়।

এটি 2026-এর সংজ্ঞায়িত চীনা ল্যাব থেকে ওপেন-ওয়েট মোমেন্টামও অব্যাহত রেখেছে। আলিবাবার কুয়েন পরিবার এই বছর বিশ্বব্যাপী সবচেয়ে বেশি ডাউনলোড হওয়া মডেল লাইনগুলির মধ্যে রয়েছে, বিকাশকারীর মন ভাগের জন্য মেটা, ডিপসিক এবং মুনশট এআই-এর রিলিজের সাথে প্রতিযোগিতা করে। Qwen 3.8 27B-এর জন্য স্বাধীন বেঞ্চমার্ক ফলাফল এখনও জমা হচ্ছে, এবং উইলিসন স্পষ্টভাবে সতর্ক করেছেন যে ল্যাবের স্ব-প্রতিবেদিত নম্বরগুলি তৃতীয় পক্ষের যাচাইয়ের জন্য অপেক্ষা করছে।

ব্যবহারকারীদের জন্য ব্যবহারিক নির্দেশিকা

মডেলটি বিবেচনা করে বিকাশকারী এবং উত্সাহীদের জন্য, প্রাথমিক পরীক্ষা থেকে উদীয়মান ঐক্যমত্য সহজবোধ্য: Qwen 3.8 27B স্থানীয় AI ওয়ার্কলোডগুলির জন্য একটি শক্তিশালী ডিফল্ট পছন্দ যা দৃষ্টি বা দীর্ঘ নথি জড়িত, তবে যুক্তির প্রচেষ্টাকে টাস্কের সাথে সংযুক্ত করা উচিত। জটিল বিশ্লেষণ `xhigh` ন্যায্যতা দিতে পারে; দৈনন্দিন প্রশ্ন এবং দ্রুত খসড়াগুলি `মাঝারি` বা নীচে দ্রুত এবং সস্তা।

এলএম স্টুডিওর মতো টুলের মাধ্যমে মডেল চালানো ব্যবহারকারীদেরও ডিফল্ট প্রসঙ্গ উইন্ডোটি 8,192 টোকেন থেকে উত্থাপন করা উচিত — উইলিসন পূর্ণ 262,144-টোকেন প্রসঙ্গ সহ এটি লোড করার আগে মডেলটির বর্ধিত চিন্তাভাবনা এমনকি জাগতিক সমস্যাগুলির জন্য বাজেটটি নিঃশেষ করে দেখেছেন।

ওপেন-মডেল রেসের পরবর্তী পর্বের রিলিজটি কী নির্দেশ করে তা হল বড় প্রশ্ন: যুক্তি-শৈলীর মডেলগুলি আদর্শ হয়ে উঠেছে, কনফিগারেশন ডিফল্টগুলি বাস্তব ব্যবহারযোগ্যতার ফলাফলের সাথে পণ্যের সিদ্ধান্তে পরিণত হচ্ছে — এবং Qwen এর `xhigh` ডিফল্ট ইতিমধ্যেই সবচেয়ে আলোচিত উদাহরণ।

খোলা ওজনের জন্য একটি মাইলফলক

ওপেন-ওয়েট ল্যাবগুলি এখন ছোট স্কেলে কী সরবরাহ করতে পারে তার রিলিজটি একটি মাইলফলক চিহ্নিত করে। দৃষ্টি ক্ষমতা, একটি 262,144-টোকেন প্রসঙ্গ উইন্ডো এবং একটি ভোক্তা ল্যাপটপে ফিট করে এমন একটি প্যাকেজে প্রতিযোগিতামূলক যুক্তি কার্যক্ষমতা দুই বছর আগে একটি Apache-2.0-লাইসেন্সযুক্ত মডেলে কল্পনা করা যায় না। স্থানীয়-প্রথম অ্যাপ্লিকেশন নির্মাণকারী ডেভেলপারদের জন্য — যেখানে ডেটা গোপনীয়তা, লেটেন্সি বা অফলাইন অপারেশন ক্লাউড এপিআইকে বাতিল করে — ব্যবহারিক বিকল্পগুলি দ্রুত ক্লিপে উন্নতি করতে থাকে।

উইলিসনের পরীক্ষা ইকোসিস্টেমের জন্য একটি পরিপক্কতা বিন্দুকেও তুলে ধরে: স্থানীয় মডেলগুলির চারপাশে টুলিং, LM স্টুডিওর এক-ক্লিক GGUF ডাউনলোড থেকে কনফিগারযোগ্য যুক্তি পরামিতি পর্যন্ত, যথেষ্ট উন্নত হয়েছে যে একটি মডেলের চিন্তার গভীরতা টিউন করা এখন একটি গবেষণা অনুশীলনের পরিবর্তে একটি রুটিন ব্যবহারকারীর সিদ্ধান্ত। আগামী দিনে যেমন স্বাধীন মানদণ্ড জমা হচ্ছে, Qwen 3.8 27B এর খোলা এবং বন্ধ প্রতিযোগীদের বিপরীতে ঠিক কোথায় অবস্থান করছে তার চিত্রটি তীক্ষ্ণ হবে — তবে প্রাথমিক অভ্যর্থনা লাইনে আরেকটি শক্তিশালী প্রবেশের পরামর্শ দেয় যা আলিবাবাকে বিশ্বের সবচেয়ে ফলপ্রসূ ওপেন-মডেল প্রকাশকদের মধ্যে একটি করে তুলেছে।

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →