ইউরোপীয় AI কোম্পানি মাল্টিভার্স কম্পিউটিং Quasar 438B চালু করেছে, একটি বৃহৎ যুক্তি মডেল যা কোম্পানি বলে যে ইউরোপে নির্মিত সবচেয়ে বুদ্ধিমান এআই মডেল। কোম্পানির ঘোষণা অনুযায়ী, Quasar 438B কৃত্রিম বিশ্লেষণ বুদ্ধিমত্তা সূচকে 43 স্কোর করেছে, যে বেঞ্চমার্কে পরিমাপ করা যেকোনো ইউরোপীয় মডেলের সর্বোচ্চ ফলাফল।
লঞ্চটি স্প্যানিশ ফার্মের জন্য একটি উল্লেখযোগ্য পদক্ষেপ চিহ্নিত করে, যেটি ফ্রন্টিয়ার-স্কেল সিস্টেমের প্রশিক্ষণের পরিবর্তে এআই মডেল কম্প্রেশনে তার খ্যাতি তৈরি করেছে। Quasar 438B হল প্রথম বৃহৎ মডেল মাল্টিভার্স কম্পিউটিং প্রকাশ করেছে, এবং ইউরোপীয় সরকার এবং কোম্পানিগুলি AI সক্ষমতার জন্য চাপ দেওয়ার ফলে এটি আসে যা আমেরিকান এবং চীনা ল্যাবগুলির উপর সম্পূর্ণ নির্ভর করে না। আমাদের এআই নিউজ কভারেজ অনুসরণকারী পাঠকদের জন্য, রিলিজটি এও ইঙ্গিত দেয় যে সীমান্ত মডেলগুলির সাথে ব্যবধান বন্ধ করার দৌড় আর সাধারণ মার্কিন প্রতিযোগীদের মধ্যে সীমাবদ্ধ নয়।
কোয়াসার 438B আসলে কী স্কোর করে
কৃত্রিম বিশ্লেষণ বুদ্ধিমত্তা সূচক (সংস্করণ 4.1.1) GDPval-AA v2, tau3-ব্যাঙ্কিং, টার্মিনাল-বেঞ্চ v2.1, SciCode, হিউম্যানিটির শেষ পরীক্ষা, GPQA ডায়মন্ড, CritPt, AA-অমনিসিসেন্স এবং সহ নয়টি মূল্যায়নকে একত্রিত করে। কোম্পানির ঘোষণা অনুযায়ী Quasar 438B-এর কম্পোজিট স্কোর 43 এটিকে Mistral Medium 3.5-এর থেকে 30-এ, NVIDIA-এর Nemotron 3 Ultra-কে 38-এ এবং Inkling-কে 42-এ এগিয়ে রাখে।
বিস্তৃত ক্ষেত্রটি এখনও আমেরিকান সীমান্তের অন্তর্গত: ক্লদ ওপাস 5 সূচকে 63-এ এগিয়ে রয়েছে। মাল্টিভার্স কম্পিউটিং অন্যথায় দাবি করে না। পরিবর্তে, কোম্পানি Quasar 438B কে সবচেয়ে শক্তিশালী ইউরোপীয় বিকল্প হিসাবে ফ্রেম করেছে, এটি হাইলাইট করা আটটি নির্বাচিত কৃত্রিম বিশ্লেষণ মূল্যায়নের মধ্যে সাতটিতে তুলনামূলক ইউরোপীয় মডেলকে ছাড়িয়ে গেছে।
গতি দ্বিতীয় যুক্তি
কাঁচা বেঞ্চমার্ক স্কোর মাল্টিভার্স কম্পিউটিং এর পিচের মাত্র অর্ধেক। কোম্পানি বলছে Quasar 438B 500 টোকেন ফেরত দেয়, চিন্তার সময় অন্তর্ভুক্ত, 15.3 সেকেন্ডে। এর তুলনা মডেলগুলির মধ্যে, শুধুমাত্র নেমোট্রন 3.5 লাইটনিং (9.4 সেকেন্ড), জেমিনি 3.5 ফ্ল্যাশ-লাইট (10.8 সেকেন্ড) এবং জেমিনি 3.7 ফ্ল্যাশ (11.5 সেকেন্ড) দ্রুত, এবং শুধুমাত্র জেমিনি 3.7 ফ্ল্যাশ উভয়ই দ্রুত এবং সূচকে আরও সক্ষম।
মিস্ট্রাল মিডিয়াম 3.5 এর সাথে তুলনা উভয় অক্ষে একদিকে চলে: কোয়াসার স্কোর বেশি (30 এর বিপরীতে 43) এবং দ্রুত উত্তর দেয় (18.8 সেকেন্ডের বিপরীতে 15.3 সেকেন্ড)। ইনকলিং, যা প্রায় 42-এ কোয়াসারের বুদ্ধিমত্তার সাথে মিলে যায়, একই 500-টোকেন প্রতিক্রিয়ার জন্য 48.3 সেকেন্ডের প্রয়োজন, তিনগুণেরও বেশি।
শক্তিশালী দীর্ঘ-প্রসঙ্গ যুক্তি
ঘোষণা থেকে একটি ফলাফল দাঁড়ায়: AA-LCR-তে, মূল্যায়ন যা দীর্ঘ নথি জুড়ে ছড়িয়ে থাকা তথ্যের নিষ্কাশন, সংযোগ এবং যুক্তির ক্ষমতা পরীক্ষা করে, Quasar 438B স্কোর 75.0। এটি Grok 4.6 (উচ্চ) এর সাথে স্তর, 75.7 এ Claude Opus 5 এর একটি বিন্দুর মধ্যে এবং 75.3 এ Qwen3.8 2.4T A95B এর চেয়ে এগিয়ে, কোম্পানির পরিসংখ্যান অনুসারে।
দীর্ঘ-প্রসঙ্গ হ্যান্ডলিং বিষয়গুলি কারণ এন্টারপ্রাইজ গবেষণা, নথি বিশ্লেষণ এবং এজেন্টিক কর্মপ্রবাহ এটির উপর নির্মিত। যদি একটি মডেল একটি দীর্ঘ নথি জুড়ে তথ্য ধরে রাখতে এবং সংযোগ করতে না পারে, তবে এটি মাল্টি-স্টেপ টুল কোম্পানিগুলিকে আসলে মোতায়েন করতে চায় না। এখানেই কোয়াসার ফ্রন্টিয়ার গ্রুপের সবচেয়ে কাছাকাছি আসে।
এজেন্টিক কোডিং এখনও হেডরুম আছে
ঘোষণার সবচেয়ে দুর্বল ফলাফল হল টার্মিনাল-বেঞ্চ v2.1, যা কোডিং এজেন্টদের বাস্তব টার্মিনাল পরিবেশে কাজ করতে দেয়। কোয়াসার 438B স্কোর 69.3, মিস্ট্রাল মিডিয়ামকে 18.7 পয়েন্টে 3.5 এবং নেমোট্রন 3 আল্ট্রা 15.4 পয়েন্টে এগিয়ে, কিন্তু ক্লাউড ওপাস 5 এর নেতৃত্বাধীন ফ্রন্টিয়ার গ্রুপ থেকে 89.1 পয়েন্টে পিছিয়ে। মাল্টিভার্স কম্পিউটিং স্বীকার করে যে এটি সর্বাধিক হেডরুমের সাথে মূল্যায়ন এবং বলে যে কাজটির পরবর্তী রাউন্ড এটিকে লক্ষ্য করে।
এন্টারপ্রাইজ এজেন্টদের জন্য নির্মিত
Quasar 438B সফটওয়্যার ডেভেলপমেন্ট এজেন্ট, টেকনিক্যাল কপিলট, রিসার্চ সিস্টেম এবং ওয়ার্কফ্লো অটোমেশন চালিত সংস্থাগুলির জন্য একটি মডেল হিসাবে অবস্থান করছে। এটি 400-বিলিয়ন-প্যারামিটার-প্লাস ক্লাসে বসে, ইংরেজি এবং স্প্যানিশ পরিচালনা করে এবং এটি বহু-পদক্ষেপের কাজের জন্য ডিজাইন করা হয়েছে যেগুলির জন্য পরিকল্পনা, টুল ব্যবহার, কোড এক্সিকিউশন এবং বৃহৎ প্রসঙ্গ প্রয়োজন ছাড়াই ক্লাসটি সাধারণত বহন করে।
অ্যাক্সেস কোম্পানির CompactifAI API-এর মাধ্যমে চলে, তাই দলগুলি তাদের নিজস্ব অবকাঠামো না দাঁড় করিয়ে মডেলটি পরীক্ষা করতে পারে৷ মাল্টিভার্স কম্পিউটিং বলছে কোয়াসারের জন্য আরও আপডেট আসছে।
ইউরোপীয় এআই রেসের জন্য এর অর্থ কী
রিলিজটি ইউরোপীয় AI এর জন্য একটি অদ্ভুত মুহুর্তে অবতরণ করে। মিস্ট্রাল, দীর্ঘকাল ধরে মহাদেশের মান-ধারক, তার দিকনির্দেশ সম্পর্কে প্রশ্নের সম্মুখীন হয়েছে, যখন ইউএস ল্যাবগুলি যৌগিক বেঞ্চমার্কগুলিতে তাদের নেতৃত্বকে একীভূত করেছে। একটি ইউরোপীয় মডেল যা বৈধভাবে একটি স্বাধীন-ইশ সূচকে ইউরোপীয় ক্ষেত্রের শীর্ষে রয়েছে মহাদেশের উদ্যোগগুলিকে একটি বিশ্বাসযোগ্য আঞ্চলিক বিকল্প দেয়, বিশেষ করে দ্বিভাষিক ইংরেজি-স্প্যানিশ স্থাপনার জন্য।
Quasar 438B সেই অবস্থানে আছে কিনা তা অন্য বিষয়। কোম্পানি নিজেই নোট করে যে শুধুমাত্র সূচকের নেতাদের একটি ভগ্নাংশ দ্রুত উত্তর দেয়, এবং ক্লদ ওপাস 5 এর ব্যবধান বিশ পয়েন্ট প্রশস্ত থাকে। কিন্তু কম্প্রেশন-ফার্স্ট কোম্পানি এখন দেখিয়েছে যে এটি হেভিওয়েট ক্লাসে প্রতিদ্বন্দ্বিতা করতে পারে এবং ইউরোপীয় এন্টারপ্রাইজগুলো শেষ পর্যন্ত তাদের ইউএস ডিফল্টের বিপরীতে বেঞ্চমার্ক করার মতো একটি হোম-মার্কেট মডেল পেয়েছে।
এআই থেকে এগিয়ে থাকুন
এআই ল্যান্ডস্কেপ ঘণ্টায় বদলে যায়, এবং বেঞ্চমার্ক লিডগুলি যা জানুয়ারীতে অনুপস্থিত দেখায় গ্রীষ্মে চলে যায়। এআই বাজ ওয়্যারে আরও AI খবর পড়ুন প্রতিটি মডেল রিলিজ, বেঞ্চমার্ক ফলাফল এবং নীতি পরিবর্তনের সাথে সাথে এটি ঘটতে পারে।
এখানে সাম্প্রতিকতম AI উন্নয়নগুলি অনুসরণ করুন।