آزمایشگاه هوش مصنوعی چینی Moonshot AI Kimi K3 را در 16 ژوئیه 2026 رونمایی کرد و آنچه را که آن را "اولین مدل باز کلاس 3T در جهان" می نامد منتشر کرد - یک سیستم 2.8 تریلیون پارامتری که فاصله را با قدرتمندترین مدل های اختصاصی Anthropic و OpenAI کاهش می دهد. این راهاندازی بلافاصله به یکی از بحثبرانگیزترین نسخههای هوش مصنوعی در سال تبدیل شد، که به صدر اخبار هکر رسید و پوشش خبری رویترز، بلومبرگ و نیویورک تایمز را جلب کرد.
برای گستردهتر [پوشش صنعت هوش مصنوعی] (https://aibuzzwire.news)، Kimi K3 اهمیت دارد، زیرا مرز مدلهای با وزن باز را به شدت بالاتر میبرد و در عین حال بحث جدیدی را در مورد اینکه آیا سیستمهای قابل دانلود رایگان میتوانند با سیستمهای بسته همخوانی داشته باشند یا خیر. مون شات می گوید وزن کامل مدل تا 27 جولای 2026 منتشر خواهد شد.
یک مدل باز 2.8 تریلیون پارامتری
بر اساس اعلامیه فنی مون شات، Kimi K3 یک مدل 2.8 تریلیون پارامتری است که بر اساس دو بهروزرسانی معماری ساخته شده است که شرکت Kimi Delta Attention (KDA) و Attention Residuals (AttnRes) نامیده میشود. این برنامه از یک طرح ترکیبی از متخصصان (MoE) استفاده می کند که تنها 16 کارشناس از 896 کارشناس را برای هر توکن مشخصی فعال می کند، که با آنچه مون شات به عنوان یک چارچوب پنهان پنهان پایدار توصیف می کند، جفت می شود. این شرکت ادعا می کند که این تغییرات در مقایسه با مدل قبلی کیمی K2، تقریباً 2.5 برابر بهبود راندمان کلی مقیاس بندی را به همراه دارد.
این مدل همچنین با قابلیتهای دید بومی و یک پنجره زمینه یک میلیون توکن عرضه میشود. تحلیلگر Simon Willison که در وبلاگ خود می نویسد، خاطرنشان کرد که Kimi K3 تاج با اندازه باز را از نسخه 1.6 تریلیون پارامتری v4 Pro DeepSeek گرفته است - "بیش از دو برابر اندازه" Kimi K2.6 با یک تریلیون پارامتر قبل از آن.
Moonshot انتشار را به عنوان آخرین گام در یک فشار مقیاسپذیری پایدار قاب میکند و میگوید که در نه ماه از دوازده ماه گذشته مدلهای آن حد بالایی اندازههای مدل باز را تعیین کردهاند.
چگونه در معیارها مقایسه می شود
مجموعه ارزیابی خود Moonshot عملکرد کلی Kimi K3 را تنها پشت سر دو سیستم اختصاصی Anthropic's Claude Fable 5 و OpenAI's GPT-5.6 Sol قرار می دهد، در حالی که به طور مداوم از سایر مدل های آزمایش شده، از جمله Claude Opus 4.8 و GPT-5.5 برتری دارد. تجزیه و تحلیل شخص ثالث به طور گسترده این ادعاها را دنبال می کند.
سرویس ارزیابی مستقل Artificial Analysis گزارش داد که در معیار کار دانش افق بلند خصوصی خود، Kimi K3 به Elo کلی 1547 رسیده است — جهشی 732 امتیازی نسبت به Kimi K2.6 و پس از تنها Claude Fable 5. در Arena.ai در Frontend Code، Kimi K3 با توجه به یک عدد پیشتاز F به یک عدد پیشرو، یک پله بالاتر از F را پشت سر گذاشت. پستی که پس از راه اندازی به طور گسترده منتشر شد.
قیمت گذاری بخش قابل توجهی از داستان است. تجزیه و تحلیل مصنوعی میانگین هزینه هر کار را 0.94 دلار تعیین کرد که با قیمت 1.04 دلاری GPT-5.6 Sol و تقریباً نیمی از 1.80 دلار کلود اوپوس 4.8 قابل مقایسه است، در حالی که اشاره کرد که Kimi K3 21٪ کمتر از نسخه قبلی خود از توکن های خروجی استفاده می کند. بر اساس هر توکن، قیمت این مدل 3 دلار در هر میلیون توکن ورودی و 15 دلار در هر میلیون توکن خروجی است - همان سطح سری کلود سونت آنتروپیک و همانطور که ویلیسون مشاهده کرد، گرانترین مدل عرضه شده توسط آزمایشگاه هوش مصنوعی چینی تا به امروز، از قیمت 0.95 دلاری Kimi K2.6.
کدنویسی عامل و کامپایلری که خودش ساخته است
بیشتر اعلامیه Moonshot نه بر معیارهای چت بات، بلکه بر روی وظایف نمایندگی بلند مدت متمرکز بود. این شرکت میگوید Kimi K3 میتواند جلسات مهندسی طولانیتری را حفظ کند، در مخازن بزرگ کد حرکت کند و ابزارهای ترمینال را با حداقل نظارت انسانی هماهنگ کند.
در یکی از نمایشها، مونشات گفت که نسخه اولیه Kimi K3 اکثر کارهای بهینهسازی هسته GPU خود تیم را در مراحل آخر توسعه انجام میدهد. در مدلی دیگر، این مدل «MiniTriton» را ساخت، یک کامپایلر فشرده پردازشگر گرافیکی تریتون مانند با نمایش متوسط در سطح کاشی، پاسهای بهینهسازی و خط لوله تولید کد PTX. Moonshot ادعا میکند که MiniTriton با تریتون و پشتههای torch.compile در معیارهای پشتیبانیشده در پشت بام مطابقت دارد یا آنها را شکست میدهد و آموزش سرتاسری nanoGPT را با همگرایی پایدار ادامه میدهد.
این شرکت همچنین اثبات قابل توجهی از مفهوم در طراحی تراشه را به نمایش گذاشت. طبق گزارشها، Kimi K3 در یک اجرای مستقل 48 ساعته، تراشهای را طراحی، بهینهسازی و تأیید کرد که برای ارائه یک مدل نانو بر اساس معماری خود، با استفاده از ابزار منبع باز EDA در کتابخانه 45 نانومتری Nangate ساخته شده است. مون شات گفت این طراحی زمان بندی را در 100 مگاهرتز در 4 میلی متر مربع بسته می کند و بیش از 8700 توکن در ثانیه از توان رمزگشایی را در شبیه سازی حفظ می کند.
در بخش تحقیقاتی، مونشات گفت که کیمی کی 3 روابط جهانی I-Love-Q را از اخترفیزیک محاسباتی در حدود دو ساعت بازتولید کرد - کاری که شرکت تخمین میزند معمولاً یک تا دو هفته طول میکشد - با اعتبارسنجی متقاطع بیش از 20 مقاله، پیادهسازی یک خط لوله کامل عددی بر روی 300 معادله نوشتن بیش از 30، و نوشتن معادله 30،0.
بحث وزن باز باز می گردد
ورود Kimi K3 بحثی را برانگیخت که تا سال 2026 ادامه داشت، زیرا آزمایشگاه های چینی بارها فاصله مدل های مرزی ایالات متحده را بسته اند - یا به نظر می رسد نزدیک می شوند. این الگو اکنون آشنا است: یک نسخه چینی اعداد گزارش شده توسط خود را در نزدیکی بالای تابلوهای امتیازات منتشر می کند، آزمایشگاه های غربی بر مزیت اختصاصی خود که هنوز در حال رشد هستند تاکید می کنند، و کسب و کارها هزینه و باز بودن را در مقابل قابلیت خام می سنجند.
این تنش در قیمت گذاری قابل مشاهده است. مدلی که از Claude Opus 4.8 در هزینه به ازای هر کار پایینتر میآید و در عین حال به تواناییهای خود نزدیک میشود، اما بیش از هر نسخه قبلی چینی شارژ میشود، نشاندهنده اطمینان Moonshot است که میتواند حتی در یک اکوسیستم باز هم قیمتهای ممتازی داشته باشد. ویلیسون نسبت به خواندن بیش از حد در هر معیاری هشدار داد - او نوشت: آزمایش طولانی مدت او "پلیکان روی دوچرخه" دیگر با کیفیت دنیای واقعی ارتباط قابل اعتمادی ندارد - اما گفت که انتشار هنوز برای آزمایش عملی پاداش دارد.
Kimi K3 اکنون از طریق Kimi.com، عامل دسکتاپ Kimi Work، ابزار توسعهدهنده Kimi Code و Kimi API در دسترس است. مون شات گفت که با شرکای استنتاج و نگهبانان منبع باز کار می کند تا از عرضه قابل اعتماد قبل از انتشار وزن کامل اطمینان حاصل کند.
از هوش مصنوعی جلوتر بمانید
برای پوشش مداوم نسخههای مدل، نبردهای معیار، و مرزهای وزن باز، [AI Buzz Wire] (https://aibuzzwire.news) را برای پیشرفتهایی که مسابقه هوش مصنوعی جهانی را شکل میدهند دنبال کنید.
اخبار مدل هوش مصنوعی را بیشتر بخوانید →


