মার্কিন যুক্তরাষ্ট্র এবং ইউনাইটেড কিংডম সরকারের AI নিরাপত্তা সংস্থাগুলির একটি যৌথ প্রাথমিক মূল্যায়ন এই সিদ্ধান্তে পৌঁছেছে যে মুনশট এআই-এর ওপেন-ওয়েট কিমি K3 মডেল আক্রমণাত্মক সাইবার টাস্কগুলিতে বিস্তৃত ব্যবধানে মার্কিন সীমান্তের মডেলগুলিকে এগিয়ে নিয়ে যাচ্ছে৷ 25 শে জুলাই, 2026-এ প্রকাশিত অনুসন্ধানটি মার্কিন যুক্তরাষ্ট্রের অভ্যন্তরে গ্রহণ করার সাথে সাথে চীনা-উন্নত AI সিস্টেমগুলিকে কীভাবে বিবেচনা করা উচিত তা নিয়ে একটি তীব্র বিতর্কের জন্য একটি নির্দিষ্ট ডেটা পয়েন্ট যোগ করে।
মূল্যায়নটি ইউএস এআই সেফটি ইনস্টিটিউট দ্বারা প্রকাশিত হয়েছিল যা NIST-এ অবস্থিত, যা CAISI নামে পরিচিত, যুক্তরাজ্যের AISI এর সাথে। এটি সাইবার ডোমেনের উপর বিশেষভাবে দৃষ্টি নিবদ্ধ করা Kimi K3-এর প্রথম অফিসিয়াল পশ্চিমা মূল্যায়নের একটি প্রতিনিধিত্ব করে। ব্রেকিং এআই নিউজ এর দ্রুত গতিশীল ল্যান্ডস্কেপ অনুসরণ করা পাঠকদের জন্য, ফলাফলটি যেকোন একক বেঞ্চমার্ক স্কোরের জন্য কম লক্ষণীয় যে এটি বিদেশী মডেলগুলিকে ব্যাপকভাবে মোতায়েন করার আগে সরকারি ল্যাবগুলিকে যাচাই করার ক্ষেত্রে এখন যে ভূমিকা পালন করে তা সম্প্রসারণ করে।
কি মূল্যায়ন পরিমাপ
কিমি K3, বেইজিং-ভিত্তিক মুনশট এআই দ্বারা প্রকাশিত, একটি বড় ওপেন-ওয়েট মডেল যা লঞ্চের পরে শক্তিশালী সাধারণ-উদ্দেশ্য কার্যকারিতার জন্য দ্রুত বিশ্বব্যাপী মনোযোগ আকর্ষণ করেছে। এর উন্মুক্ত বিতরণের অর্থ হল গবেষক এবং বিকাশকারীরা সরাসরি ওজনগুলি ডাউনলোড এবং পরিদর্শন করতে পারে, যার ফলে এটিকে বাহ্যিক নিরাপত্তা পরীক্ষার জন্য একটি প্রাকৃতিক প্রার্থী করে তুলেছে।
নতুন প্রাথমিক প্রতিবেদনটি একটি সংকীর্ণ এবং আরও সংবেদনশীল প্রশ্নের উপর মনোনিবেশ করে: আক্রমণাত্মক সাইবার অপারেশনের মডেলটি কতটা সক্ষম, জাতীয়-নিরাপত্তা সংস্থাগুলির জন্য যে ধরনের কাজগুলি সবচেয়ে গুরুত্বপূর্ণ? বিস্তৃত জ্ঞান বা যুক্তির উপর কিমি কে 3 মূল্যায়ন করার পরিবর্তে, ইনস্টিটিউটগুলি এটি সাইবার আক্রমণ চালাতে, সফ্টওয়্যার দুর্বলতাগুলিকে কাজে লাগাতে, বা অন্যথায় দূষিত কম্পিউটার ক্রিয়াকলাপে সহায়তা করতে পারে কিনা তা পরীক্ষা করে।
সংখ্যা: মোটামুটি 32% বনাম 76%
শিরোনাম ফলাফল একটি ধারালো ফাঁক. সাইবার-ক্ষমতা মূল্যায়নে, কিমি K3 আনুমানিক 32% স্কোর করেছে, যখন নেতৃস্থানীয় ইউএস ফ্রন্টিয়ার মডেলগুলি 76% এর কাছাকাছি পৌঁছেছে, মূল্যায়নের প্রতিবেদন অনুসারে। সরল ভাষায় অনুবাদ করা হলে, ইউএস ইনস্টিটিউটগুলি দেখেছে যে চীনা মডেলটি পশ্চিমা মডেলগুলি পরিচালনা করে এমন আক্রমণাত্মক সাইবার কাজগুলির মাত্র এক তৃতীয়াংশ সম্পূর্ণ করতে পারে।
রিলিজ কভার করা একাধিক আউটলেট ধারাবাহিকভাবে ব্যবধান তৈরি করেছে। সাউথ চায়না মর্নিং পোস্ট রিপোর্ট করেছে যে কিমি K3 "সাইবার আক্রমণ করার ক্ষমতায় মার্কিন প্রতিদ্বন্দ্বীদের থেকে ভালোভাবে পিছিয়ে আছে," যখন ইন্টারেস্টিং ইঞ্জিনিয়ারিং সাইবার বেঞ্চমার্কে 32% স্প্রেডের বিপরীতে 76% হাইলাইট করেছে। মূল্যায়নটি প্রাথমিক হিসাবে বর্ণনা করা হয়েছে, যার অর্থ প্রতিষ্ঠানগুলি ইঙ্গিত দিচ্ছে যে কোনও চূড়ান্ত সিদ্ধান্ত নেওয়ার আগে আরও পরীক্ষার সম্ভাবনা রয়েছে।
কেন গ্যাপ থাকতে পারে
একটি মডেল যা সাধারণ মানদণ্ডে দৃঢ়ভাবে পারফর্ম করে কিন্তু সাইবার অপরাধে দুর্বলভাবে একটি আকর্ষণীয় ধাঁধা উপস্থাপন করে, এবং বিশ্লেষকরা ইতিমধ্যেই ওজন করতে শুরু করেছেন। দ্য ডিকোডার-এ লেখা, ভাষ্যকাররা উল্লেখ করেছেন যে পাতন অসঙ্গতির অংশ ব্যাখ্যা করতে পারে।
পাতন হল একটি প্রশিক্ষণ কৌশল যেখানে একটি মডেল স্ক্র্যাচ থেকে প্রতিটি সক্ষমতা তৈরি করার পরিবর্তে আরও দক্ষ "শিক্ষক" মডেলের আউটপুট অনুকরণ করে শেখে। যদি কিমি K3 আংশিকভাবে পাতনের মাধ্যমে বিকশিত হয়, বিশ্লেষকরা যুক্তি দেন, এটি তার শিক্ষক হিসাবে যে মডেলটি কাজ করে তার দ্বারা নির্ধারিত ক্ষমতার উপর একটি সিলিং উত্তরাধিকারী হতে পারে, যা অত্যাধুনিক আক্রমণাত্মক সাইবার অপারেশনগুলির মতো কঠিনতম কাজগুলিতে সম্ভাব্যভাবে কর্মক্ষমতা সীমিত করে।
সেই হাইপোথিসিস রয়ে গেছে শুধুই, একটা হাইপোথিসিস। প্রাথমিক রিপোর্টে কেন এই ব্যবধান বিদ্যমান, কেবল তা বিদ্যমান রয়েছে তা নিষ্পত্তি করে না। অন্যান্য সম্ভাব্য কারণগুলির মধ্যে রয়েছে ইচ্ছাকৃত ক্ষমতার সীমাবদ্ধতা, প্রশিক্ষণের ডেটাতে পার্থক্য, বা ব্যাপকভাবে উপলব্ধ হার্ডওয়্যারে চালানোর জন্য মডেলটিকে যথেষ্ট দক্ষ রাখার জন্য তৈরি করা ট্রেড-অফ।
একটি অভিযুক্ত রাজনৈতিক প্রেক্ষাপট
মূল্যায়ন চীনের এআই সিস্টেমগুলিকে যাচাই করার জন্য মার্কিন যুক্তরাষ্ট্রের বৃহত্তর চাপের মাঝখানে। জুলাইয়ের শুরুতে, ট্রাম্প প্রশাসন সাইবার নিরাপত্তার উদ্বেগের কথা উল্লেখ করে মার্কিন যুক্তরাষ্ট্রের অভ্যন্তরে চীনা-উন্নত এআই মডেলের ব্যবহার সীমাবদ্ধ করার প্রচেষ্টা পুনরুজ্জীবিত করেছিল, সেই আলোচনায় বারবার কিমি কে 3-এর নাম ছিল। মার্কিন আইন প্রণেতারা আলাদাভাবে আমেরিকান কোম্পানিগুলোকে তাদের পণ্যে বিদেশী মডেল একীভূত করার তথ্য-নিরাপত্তার প্রভাব নিয়ে চাপ দিয়েছেন।
সেই পটভূমিতে, একটি সরকার আবিষ্কার করেছে যে সবচেয়ে বিশিষ্ট চীনা ওপেন-ওয়েট মডেল দুটি দিক থেকে অপরাধ কাটতে কম পারফর্ম করে। যারা বিধিনিষেধের জন্য তর্ক করছেন তাদের জন্য, এটি সরকারী প্রমাণ সরবরাহ করে যে মডেলটিকে যথেষ্ট গুরুত্ব সহকারে পরীক্ষা করা হচ্ছে। যারা অত্যধিক পৌঁছানোর বিষয়ে সতর্ক থাকেন তাদের জন্য, তুলনামূলকভাবে কম সাইবার স্কোর সেই বর্ণনাটিকে জটিল করে তোলে যে প্রতিটি চীনা মডেল একটি তাৎক্ষণিক সাইবার হুমকির প্রতিনিধিত্ব করে।
খোলা ওজন গ্রহণের জন্য এর অর্থ কী
ফলাফলটি ওপেন-ওয়েট এআই নিয়ে আরও বিস্তৃতভাবে একটি পৃথক বিতর্কের দিকে নিয়ে যায়। ওপেন-ওয়েট মডেলের প্রবক্তারা যুক্তি দেন যে অবাধে ডাউনলোডযোগ্য ওজনগুলি স্বাধীন নিরাপত্তা পরীক্ষা করতে সক্ষম করে ঠিক যেমন CAISI এবং UK AISI পরিচালিত, উন্মুক্ত বিতরণকে নিরাপত্তার জন্য একটি নেট ইতিবাচক করে তোলে। সমালোচকরা পাল্টা বলছেন যে একই উন্মুক্ততা দূষিত অভিনেতাদের সক্ষম সিস্টেমগুলি সংশোধন বা অপব্যবহার করতে বাধা কমিয়ে দেয়।
কিমি K3-এর ক্ষেত্রে, ওপেন-ওয়েট প্রাপ্যতাই এই স্বাধীন সরকারি মূল্যায়নকে সম্ভব করেছে। তুলনামূলকভাবে শালীন সাইবার স্কোর আশ্বস্ত করা বা অ্যালার্ম নীতিনির্ধারকদের সংখ্যার উপর কম এবং মার্কিন এবং যুক্তরাজ্যের এজেন্সিগুলি আগামী সপ্তাহগুলিতে কীভাবে এটি ফ্রেম করতে বেছে নেয় তার উপর নির্ভর করতে পারে।
আপাতত, প্রাথমিক মূল্যায়নটি একটি রেফারেন্স পয়েন্ট হিসাবে দাঁড়িয়েছে: Kimi K3-এর আক্রমণাত্মক সাইবার ক্ষমতার প্রথম অফিসিয়াল পশ্চিমা পরিমাপ, এবং একটি যা এটিকে ফ্রন্টিয়ার ইউএস মডেলগুলির তুলনায় অনেকবারই তুলনা করা হয়।
এআই থেকে এগিয়ে থাকুন
AI নিরাপত্তা, নিয়ন্ত্রণ এবং বৈশ্বিক প্রতিযোগিতার তুলনায় অনেক বড় প্রতিযোগিতায় সাইবার-ক্ষমতার স্কোর শুধুমাত্র একটি ফ্রন্ট। নীতির ল্যান্ডস্কেপ সাপ্তাহিক পরিবর্তন হচ্ছে, এবং একটি একক মূল্যায়ন অনুপস্থিত হওয়ার অর্থ পরবর্তী শিরোনামের পিছনে প্রসঙ্গটি হারিয়ে যেতে পারে। এআই বাজ ওয়্যারে আরও AI খবর পড়ুন প্রতিটি মডেলের প্রকাশ, সরকারী রায় এবং গুরুত্বপূর্ণ নিরাপত্তা মূল্যায়নের সাথে তাল মিলিয়ে চলতে।
এআই রেসে এগিয়ে থাকুন — এআই বাজ ওয়্যার দেখুন


