Z.ai, চাইনিজ AI ল্যাব যা পূর্বে Zhipu AI নামে পরিচিত ছিল, Hugging Face-এ তার GLM-5.3 মডেলের সম্পূর্ণ ওজন প্রকাশ করেছে, এটি একটি বিনামূল্যের ডাউনলোডে উপলব্ধ শক্তিশালী কোডিং এবং এজেন্টিক মডেলগুলির একটিতে পরিণত করেছে। রিলিজটি 28 আগস্ট লাইভ হয়েছিল, ল্যাব নিশ্চিত করার কয়েকদিন পর যে "অক্স আলফা" নামে পরিচিত ভাইরাল স্টিলথ মডেলটি আসলে তার নিজস্ব GLM-5.3-ফ্ল্যাশ ছিল, এবং এটি ওপেন-ওয়েট প্রতিশ্রুতি পূরণ করে যা সম্প্রদায় সারা সপ্তাহ নিবিড়ভাবে পর্যবেক্ষণ করেছিল।
মডেল পৃষ্ঠাটি দ্রুত 1,100 টিরও বেশি লাইক সংগ্রহ করেছে, এবং রিলিজ ঘোষণাকারী হ্যাকার নিউজ থ্রেডটি 600 পয়েন্ট অতিক্রম করেছে কারণ ডেভেলপাররা এখন যা একটি পাবলিক রিপোজিটরিতে বসে আছে তা হজম করেছে: 141টি সেফটেনসর ফাইল, FP8 এ পাঠানো হয়েছে, যা এখন পর্যন্ত সবচেয়ে সক্ষম খোলাখুলিভাবে ডাউনলোডযোগ্য কোডিং মডেল হতে পারে। For more context on this story, see our ongoing artificial intelligence updates.
Z.ai আসলে কি পাঠানো হয়েছে
GLM-5.3 হল একটি মিক্সচার-অফ-বিশেষজ্ঞ মডেল যা একটি আর্কিটেকচারের উপর নির্মিত Z.ai কে glm_moe_dsa বলে। ওজনের পাশাপাশি প্রকাশিত কনফিগারেশন অনুসারে, নেটওয়ার্কটি 256 রাউটেড বিশেষজ্ঞের সাথে 78টি স্তরকে স্ট্যাক করে, প্রতি টোকেন 8 জন বিশেষজ্ঞ এবং একজন ভাগ করা বিশেষজ্ঞকে সক্রিয় করে। প্রসঙ্গ উইন্ডোটি 1,048,576 টোকেন বিস্তৃত - একটি সম্পূর্ণ মিলিয়ন - এবং মডেলটি সর্বোচ্চ থেকে ডিফল্ট হিসাবে কম, উচ্চ এবং সর্বোচ্চ সেটিংস সহ একটি "রিজনিং_এফোর্ট" প্যারামিটার সমর্থন করে৷
সম্ভবত মডেল কার্ডের সবচেয়ে আকর্ষণীয় নোট হল উন্নতিগুলি কোথা থেকে এসেছে সে সম্পর্কে একটি স্পষ্টতা: GLM-5.3 GLM-5.2-এর মতো একই বেস মডেল ব্যবহার করে এবং প্রতিটি লাভ আসে পোস্ট-ট্রেনিং থেকে। ল্যাবটি স্পষ্টভাবে ফলাফলটিকে "কোডিংয়ের জন্য সবচেয়ে সক্ষম ওপেন-ওয়েট মডেল" হিসাবে বর্ণনা করে।
বেঞ্চমার্ক: এজেন্টিক কোডিং-এ ওপেন-ওয়েটস SOTA
প্রকাশিত মূল্যায়ন সারণীটি এর পদ্ধতি সম্পর্কে ব্যাপক এবং অস্বাভাবিকভাবে সুনির্দিষ্ট, Kimi K3, DeepSeek-V4 Pro-0813, Qwen3.8-Max, Anthropic's Opus 4.8, Google's Fable 5, এবং OpenAI এর GPT-5.6 Sol-এর বিরুদ্ধে ফলাফল তালিকাভুক্ত করা।
টার্মিনাল বেঞ্চ 3.0-এ, GLM-5.3 স্কোর 28.3 — ওপেন-সোর্স স্টেট অফ দ্য আর্ট, এবং GLM-5.2-এর জন্য 4.6 থেকে একটি লাফ, যদিও এখনও 33.7-এ Fable 5 এবং 34.6-এ GPT-5.6 Sol-এর ক্লোজড ফ্রন্টিয়ারের পিছনে। টার্মিনাল বেঞ্চ 2.1-এ এটি 88.2 পোস্ট করে, মূলত কিমি K3 এবং GPT-5.6 Sol-এর সাথে লেভেল এবং Opus 4.8-এর 85.0 থেকে এগিয়ে। ডিপএসডব্লিউই ফলাফল 46.2 থেকে 66.9 সংস্করণগুলির মধ্যে লাফিয়েছে, এবং GLM-5.3 অটোমেশনবেঞ্চে 48.2 এবং GDPval-AA v2 তে 1769-এ টেবিলের শীর্ষে রয়েছে, পরবর্তীটি কৃত্রিম বিশ্লেষণ দ্বারা মূল্যায়ন করা হয়েছে।
Z.ai তার ইন-হাউস কোড বেঞ্চে GLM-5.2-এর তুলনায় 50% উন্নতির রিপোর্ট করেছে, পাশাপাশি এজেন্টদের লাস্ট পরীক্ষার মতো বেঞ্চমার্কে ওপেন-ওয়েট-সেরা ফলাফল রয়েছে।
সাইবার সক্ষমতা প্রশ্ন
মডেল কার্ডটি এমন একটি উন্নয়ন সম্পর্কে উল্লেখযোগ্যভাবে ভোঁতা যা নিরাপত্তা গবেষকরা কয়েক মাস ধরে ট্র্যাক করছেন: "আমরা প্রশিক্ষণ-পরবর্তী স্কেল করার সাথে সাথে সাইবার ক্ষমতা আমাদের প্রত্যাশার চেয়ে দ্রুত বিকাশ লাভ করেছে," কার্ডটি বলে। GLM-5.3 হল সাইবারজিমে 84.5-এ দুর্বলতা আবিষ্কারের জন্য অত্যাধুনিক, GPT-5.6 Sol সহ টেবিলের প্রতিটি মডেলকে বের করে দেয়, এবং এটি শোষণের মানদণ্ডে GLM-5.2কে দ্বিগুণ করে — 54.4 বনাম 24.4 এক্সপ্লোইটবেঞ্চে 54.4, এবং 19/319 এক্সপ্লয়েটজিমের দুই সময়ের বাজেট।
এআই বাজ ওয়্যার এই ক্ষমতাগুলিকে কভার করে যখন তারা আগস্টের মাঝামাঝি এপিআই-শুধু রিলিজ নিয়ে আবির্ভূত হয়। এখন যা পরিবর্তন হয়েছে তা হল বিতরণ: ওজনগুলি ডাউনলোডযোগ্য, কোয়ান্টাইজড কমিউনিটি বিল্ডগুলি দ্রুত অনুসরণ করার সম্ভাবনা রয়েছে এবং পর্যাপ্ত মেমরির সাথে যে কেউ স্থানীয়ভাবে মডেলটি চালাতে পারে। হ্যাকার নিউজ আলোচনায়, কিছু ব্যবহারকারী উল্লেখ করেছেন যে মডেলটি মার্কিন-হোস্ট করা বিকল্পগুলির তুলনায় নিরাপত্তা-সংলগ্ন কাজগুলির আশেপাশে কম সীমাবদ্ধতা অনুভব করেছে — একটি অফিসিয়াল নীতি দাবির পরিবর্তে সম্প্রদায়ের ইমপ্রেশন, কিন্তু কেন এই প্রকাশটি বিকাশকারীর মতো নিরাপত্তা চেনাশোনাগুলিতে আলোচনা করা হচ্ছে তার প্রতিফলন।
হাইপারস্কেলারদের লক্ষ্যে একটি লাইসেন্স
GLM-5.3-ফ্ল্যাশের বিপরীতে, যা একটি পরিষ্কার MIT লাইসেন্সের অধীনে পাঠানো হয়, GLM-5.3 একটি কাস্টম "GLM-5.3 লাইসেন্স" নিয়ে আসে। নিউ স্ট্যাক এটিকে হাইপারস্কেলারদের লক্ষ্য হিসাবে চিহ্নিত করেছে এবং পাঠ্যটি তা বহন করে। প্রায় সকলের জন্য, শর্তাবলী কার্যকরভাবে অনুমোদিত: নোটিশটি অন্তর্ভুক্ত করার প্রয়োজনের সাথে ব্যবহার করুন, অনুলিপি করুন, সংশোধন করুন, একত্র করুন, প্রকাশ করুন, বিতরণ করুন, সাবলাইসেন্স করুন এবং বিক্রি করুন৷
ব্যতিক্রমটি একটি নির্দিষ্ট ব্যবসায়িক মডেলকে লক্ষ্য করে। যদি একজন লাইসেন্সধারী বা এর সহযোগীরা একটি "পরিষেবা হিসাবে মডেল" ব্যবসা পরিচালনা করে — তৃতীয় পক্ষের অনুমান বা ফাইন-টিউনিং অ্যাক্সেস অফার করে — এবং তাদের সম্মিলিত রাজস্ব পরপর 12 মাসে $10 বিলিয়ন ছাড়িয়ে যায়, তাহলে মডেল বা এর ডেরিভেটিভের বাণিজ্যিক ব্যবহারের আগে তাদের অবশ্যই Z.ai নিরাপত্তা পর্যালোচনা পাস করতে হবে। এই ধারাটি সবচেয়ে বড় ক্লাউড প্রদানকারীর চারপাশে সুনির্দিষ্টভাবে একটি বৃত্ত আঁকে, যখন স্টার্টআপ, গবেষক, উদ্যোগ এবং মধ্য-স্কেল হোস্টগুলিকে স্পর্শ না করে।
দুই ট্র্যাক পদ্ধতি বলছে. ফ্ল্যাশ ভেরিয়েন্ট, এখন অক্স আলফা মডেল হিসাবে প্রকাশিত হয়েছে যা টেকক্রাঞ্চ এর উত্স উন্মোচন করার আগে ভাইরাল হয়েছিল, সম্পূর্ণরূপে চীনা সিলিকনে চলে এবং সর্বাধিক গ্রহণের জন্য এমআইটি পতাকা বহন করে। ফ্ল্যাগশিপটি একটি বেসপোক লাইসেন্স পায় যা হাইপারস্কেলার স্থাপনা রাখে - বিশেষ করে আমেরিকান ক্লাউড দ্বারা - Z.ai এর নিজস্ব পর্যালোচনা প্রক্রিয়ার পিছনে গেট করা।
নিজেই চালান
যারা চেষ্টা করতে আগ্রহী তাদের জন্য, মডেল কার্ডটি vLLM, SGLang, KTransformers, Unsloth, এবং Hugging Face Transformers জুড়ে ডিপ্লয়মেন্ট সমর্থন তালিকাভুক্ত করে, যার মধ্যে বেশ কয়েকটির জন্য কুকবুক রেসিপি রয়েছে। উল্লেখযোগ্যভাবে, হুয়াওয়ে অ্যাসেন্ড এনপিইউ স্থাপনাটি ভিএলএলএম-অ্যাসেন্ড, এক্সএলএলএম এবং এসজিল্যাং-এর মাধ্যমে নথিভুক্ত করা হয়েছে — নন-এনভিডিয়া হার্ডওয়্যারে ফ্রন্টিয়ার মডেলগুলি চালিত প্রমাণ করার জন্য ল্যাবের ধাক্কা অব্যাহত। সম্প্রদায়ের মধ্যে, DeepInfra ওপেনরাউটারে ওপেন মডেলের তৃতীয় পক্ষের শেষ পয়েন্ট অফার করে।
Z.ai arXiv-এর উপর একটি প্রযুক্তিগত প্রতিবেদনও প্রকাশ করেছে, যার শিরোনাম "GLM-5: Vibe Coding থেকে Agentic Engineering পর্যন্ত," মডেল পরিবারের উন্নয়নকে কভার করে।
কেন এটা গুরুত্বপূর্ণ
মুক্তি অনেক এজেন্টিক কোডিং বেঞ্চমার্কে একটি বৃত্তাকার ত্রুটিতে বন্ধ সীমান্ত এবং খোলা সীমান্তের মধ্যে ব্যবধানকে সংকুচিত করে — সপ্তাহ, বছর নয়। Kimi K3 এবং DeepSeek-V4 এর সাথে মিলিত, এর অর্থ হল সবচেয়ে বড় ল্যাবের বাইরের ডেভেলপারদের কাছে এখন বিশ্বাসযোগ্য বিকল্প রয়েছে তারা মালিকানা, নিরীক্ষা এবং সূক্ষ্ম সুর করতে পারে।
এটি কীভাবে উন্মুক্ত রিলিজগুলিকে নিয়ন্ত্রিত করা হয় তাতে পরিবর্তনের ইঙ্গিত দেয়। একটি একক মডেল পরিবারের মধ্যে এমআইটি-বনাম-কাস্টম-লাইসেন্স বিভাজন পরামর্শ দেয় যে চীনা ল্যাবগুলি কৌশলগত অবকাঠামো হিসাবে লাইসেন্সিং ব্যবহার করতে শিখছে: উন্মুক্ততা যেখানে এটি একটি ইকোসিস্টেম তৈরি করে, যেখানে এটি অবস্থান রক্ষা করে সেখানে লিভারেজ। পরবর্তী পরীক্ষা হবে যে কোনো $10-বিলিয়ন-প্লাস MaaS অপারেটর আসলে Z.ai নিরাপত্তা পর্যালোচনার জন্য জমা দেয় কি না - বা ধারাটি কেবল সবচেয়ে বড় মেঘগুলিকে দূরে রাখে কিনা যখন অন্য সবাই শীর্ষে তৈরি হয়।
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →