آزمایشگاه هوش مصنوعی چینی Moonshot AI Kimi K3 را در 16 ژوئیه 2026 رونمایی کرد و آنچه را که آن را "اولین مدل باز کلاس 3T در جهان" می نامد منتشر کرد - یک سیستم 2.8 تریلیون پارامتری که فاصله را با قدرتمندترین مدل های اختصاصی Anthropic و OpenAI کاهش می دهد. این راه‌اندازی بلافاصله به یکی از بحث‌برانگیزترین نسخه‌های هوش مصنوعی در سال تبدیل شد، که به صدر اخبار هکر رسید و پوشش خبری رویترز، بلومبرگ و نیویورک تایمز را جلب کرد.

برای گسترده‌تر [پوشش صنعت هوش مصنوعی] (https://aibuzzwire.news)، Kimi K3 اهمیت دارد، زیرا مرز مدل‌های با وزن باز را به شدت بالاتر می‌برد و در عین حال بحث جدیدی را در مورد اینکه آیا سیستم‌های قابل دانلود رایگان می‌توانند با سیستم‌های بسته همخوانی داشته باشند یا خیر. مون شات می گوید وزن کامل مدل تا 27 جولای 2026 منتشر خواهد شد.

یک مدل باز 2.8 تریلیون پارامتری

بر اساس اعلامیه فنی مون شات، Kimi K3 یک مدل 2.8 تریلیون پارامتری است که بر اساس دو به‌روزرسانی معماری ساخته شده است که شرکت Kimi Delta Attention (KDA) و Attention Residuals (AttnRes) نامیده می‌شود. این برنامه از یک طرح ترکیبی از متخصصان (MoE) استفاده می کند که تنها 16 کارشناس از 896 کارشناس را برای هر توکن مشخصی فعال می کند، که با آنچه مون شات به عنوان یک چارچوب پنهان پنهان پایدار توصیف می کند، جفت می شود. این شرکت ادعا می کند که این تغییرات در مقایسه با مدل قبلی کیمی K2، تقریباً 2.5 برابر بهبود راندمان کلی مقیاس بندی را به همراه دارد.

این مدل همچنین با قابلیت‌های دید بومی و یک پنجره زمینه یک میلیون توکن عرضه می‌شود. تحلیلگر Simon Willison که در وبلاگ خود می نویسد، خاطرنشان کرد که Kimi K3 تاج با اندازه باز را از نسخه 1.6 تریلیون پارامتری v4 Pro DeepSeek گرفته است - "بیش از دو برابر اندازه" Kimi K2.6 با یک تریلیون پارامتر قبل از آن.

Moonshot انتشار را به عنوان آخرین گام در یک فشار مقیاس‌پذیری پایدار قاب می‌کند و می‌گوید که در نه ماه از دوازده ماه گذشته مدل‌های آن حد بالایی اندازه‌های مدل باز را تعیین کرده‌اند.

چگونه در معیارها مقایسه می شود

مجموعه ارزیابی خود Moonshot عملکرد کلی Kimi K3 را تنها پشت سر دو سیستم اختصاصی Anthropic's Claude Fable 5 و OpenAI's GPT-5.6 Sol قرار می دهد، در حالی که به طور مداوم از سایر مدل های آزمایش شده، از جمله Claude Opus 4.8 و GPT-5.5 برتری دارد. تجزیه و تحلیل شخص ثالث به طور گسترده این ادعاها را دنبال می کند.

سرویس ارزیابی مستقل Artificial Analysis گزارش داد که در معیار کار دانش افق بلند خصوصی خود، Kimi K3 به Elo کلی 1547 رسیده است — جهشی 732 امتیازی نسبت به Kimi K2.6 و پس از تنها Claude Fable 5. در Arena.ai در Frontend Code، Kimi K3 با توجه به یک عدد پیشتاز F به یک عدد پیشرو، یک پله بالاتر از F را پشت سر گذاشت. پستی که پس از راه اندازی به طور گسترده منتشر شد.

قیمت گذاری بخش قابل توجهی از داستان است. تجزیه و تحلیل مصنوعی میانگین هزینه هر کار را 0.94 دلار تعیین کرد که با قیمت 1.04 دلاری GPT-5.6 Sol و تقریباً نیمی از 1.80 دلار کلود اوپوس 4.8 قابل مقایسه است، در حالی که اشاره کرد که Kimi K3 21٪ کمتر از نسخه قبلی خود از توکن های خروجی استفاده می کند. بر اساس هر توکن، قیمت این مدل 3 دلار در هر میلیون توکن ورودی و 15 دلار در هر میلیون توکن خروجی است - همان سطح سری کلود سونت آنتروپیک و همانطور که ویلیسون مشاهده کرد، گران‌ترین مدل عرضه شده توسط آزمایشگاه هوش مصنوعی چینی تا به امروز، از قیمت 0.95 دلاری Kimi K2.6.

کدنویسی عامل و کامپایلری که خودش ساخته است

بیشتر اعلامیه Moonshot نه بر معیارهای چت بات، بلکه بر روی وظایف نمایندگی بلند مدت متمرکز بود. این شرکت می‌گوید Kimi K3 می‌تواند جلسات مهندسی طولانی‌تری را حفظ کند، در مخازن بزرگ کد حرکت کند و ابزارهای ترمینال را با حداقل نظارت انسانی هماهنگ کند.

در یکی از نمایش‌ها، مون‌شات گفت که نسخه اولیه Kimi K3 اکثر کارهای بهینه‌سازی هسته GPU خود تیم را در مراحل آخر توسعه انجام می‌دهد. در مدلی دیگر، این مدل «MiniTriton» را ساخت، یک کامپایلر فشرده پردازشگر گرافیکی تریتون مانند با نمایش متوسط ​​در سطح کاشی، پاس‌های بهینه‌سازی و خط لوله تولید کد PTX. Moonshot ادعا می‌کند که MiniTriton با تریتون و پشته‌های torch.compile در معیارهای پشتیبانی‌شده در پشت بام مطابقت دارد یا آن‌ها را شکست می‌دهد و آموزش سرتاسری nanoGPT را با هم‌گرایی پایدار ادامه می‌دهد.

این شرکت همچنین اثبات قابل توجهی از مفهوم در طراحی تراشه را به نمایش گذاشت. طبق گزارش‌ها، Kimi K3 در یک اجرای مستقل 48 ساعته، تراشه‌ای را طراحی، بهینه‌سازی و تأیید کرد که برای ارائه یک مدل نانو بر اساس معماری خود، با استفاده از ابزار منبع باز EDA در کتابخانه 45 نانومتری Nangate ساخته شده است. مون شات گفت این طراحی زمان بندی را در 100 مگاهرتز در 4 میلی متر مربع بسته می کند و بیش از 8700 توکن در ثانیه از توان رمزگشایی را در شبیه سازی حفظ می کند.

در بخش تحقیقاتی، مون‌شات گفت که کیمی کی 3 روابط جهانی I-Love-Q را از اخترفیزیک محاسباتی در حدود دو ساعت بازتولید کرد - کاری که شرکت تخمین می‌زند معمولاً یک تا دو هفته طول می‌کشد - با اعتبارسنجی متقاطع بیش از 20 مقاله، پیاده‌سازی یک خط لوله کامل عددی بر روی 300 معادله نوشتن بیش از 30، و نوشتن معادله 30،0.

بحث وزن باز باز می گردد

ورود Kimi K3 بحثی را برانگیخت که تا سال 2026 ادامه داشت، زیرا آزمایشگاه های چینی بارها فاصله مدل های مرزی ایالات متحده را بسته اند - یا به نظر می رسد نزدیک می شوند. این الگو اکنون آشنا است: یک نسخه چینی اعداد گزارش شده توسط خود را در نزدیکی بالای تابلوهای امتیازات منتشر می کند، آزمایشگاه های غربی بر مزیت اختصاصی خود که هنوز در حال رشد هستند تاکید می کنند، و کسب و کارها هزینه و باز بودن را در مقابل قابلیت خام می سنجند.

این تنش در قیمت گذاری قابل مشاهده است. مدلی که از Claude Opus 4.8 در هزینه به ازای هر کار پایین‌تر می‌آید و در عین حال به توانایی‌های خود نزدیک می‌شود، اما بیش از هر نسخه قبلی چینی شارژ می‌شود، نشان‌دهنده اطمینان Moonshot است که می‌تواند حتی در یک اکوسیستم باز هم قیمت‌های ممتازی داشته باشد. ویلیسون نسبت به خواندن بیش از حد در هر معیاری هشدار داد - او نوشت: آزمایش طولانی مدت او "پلیکان روی دوچرخه" دیگر با کیفیت دنیای واقعی ارتباط قابل اعتمادی ندارد - اما گفت که انتشار هنوز برای آزمایش عملی پاداش دارد.

Kimi K3 اکنون از طریق Kimi.com، عامل دسکتاپ Kimi Work، ابزار توسعه‌دهنده Kimi Code و Kimi API در دسترس است. مون شات گفت که با شرکای استنتاج و نگهبانان منبع باز کار می کند تا از عرضه قابل اعتماد قبل از انتشار وزن کامل اطمینان حاصل کند.

از هوش مصنوعی جلوتر بمانید

برای پوشش مداوم نسخه‌های مدل، نبردهای معیار، و مرزهای وزن باز، [AI Buzz Wire] (https://aibuzzwire.news) را برای پیشرفت‌هایی که مسابقه هوش مصنوعی جهانی را شکل می‌دهند دنبال کنید.

اخبار مدل هوش مصنوعی را بیشتر بخوانید →