بر اساس گزارش بلومبرگ که در 36 جولای منتشر شده است، Moonshot AI، استارت آپ چینی پشت خانواده مدل های زبان بزرگ Kimi، پیشرفته ترین سیستم های خود را بر روی مجموعه ای از تقریباً 20000 تراشه Nvidia H200 اجرا می کند که از طریق توافقنامه قدرت محاسباتی با Alibaba ارائه شده است. از پربینندهترین آزمایشگاههای هوش مصنوعی چین و تاکید میکند که چگونه مدلهای مرزی این کشور هنوز به نیمهرساناهای غربی وابسته هستند.
به گفته افراد نزدیک به Moonshot به نقل از بلومبرگ، تراشه ها پردازنده H200 هستند، پیشرفته ترین شتاب دهنده نسل Hopper انویدیا. این خوشه که از هلدینگ گروه علی بابا اجاره شده است، بخش قابل توجهی از قدرت محاسباتی مدل های کیمی مون شات را تامین می کند - از جمله Kimi K3، که شرکت آن را به تقریباً 2.8 تریلیون پارامتر تقسیم کرده است. برای پوشش مداوم مسابقه سخت افزاری که هوش مصنوعی را تقویت می کند، [آخرین اخبار هوش مصنوعی] (https://aibuzzwire.news) ما را دنبال کنید.
چیدمان محاسبات ابری، نه مالکیت تراشه
این قرارداد بهجای خرید مستقیم سختافزار، بهعنوان یک توافقنامه قدرت محاسباتی طراحی شده است، به این معنی که Moonshot به طور مؤثری به ظرفیت انویدیا علیبابا دسترسی دارد. بلومبرگ گزارش داد که خوشه 20000 تراشه ای "بخش کلیدی" قدرت محاسباتی پشت مدل های کیمی را به خود اختصاص می دهد و پیشنهاد می کند که Moonshot این تخصیص را با ظرفیت اضافی خود تکمیل کند.
این ترتیب الگوی نوظهور در بخش هوش مصنوعی چین را برجسته میکند: به جای اینکه هر استارتآپی ذخایر GPU خود را جمع کند، غولهای ابری مانند علیبابا و تنسنت به عنوان کارگزار محاسباتی عمل میکنند و ظرفیت شتابدهنده پیشرفته را به سازندگان مدلهای کوچکتر اجاره میدهند. برای Moonshot که در اوایل سال جاری حدود 3.5 میلیارد دلار ارزش داشت، اجاره به جای خرید، مانع سرمایه برای آموزش مدلهای در مقیاس مرزی میشود.
اتکای دائمی چین به انویدیا
گزارش بلومبرگ صراحتاً این قرارداد را به عنوان شواهدی مبنی بر «اتکای مداوم چین به نیمه هادی های غربی برای تقویت توسعه هوش مصنوعی خود»، به گفته افراد مطلع از عملیات این شرکت ها، توصیف می کند. با وجود فشار گسترده تراشه های داخلی که توسط خط Ascend هوآوی و استارتاپ هایی مانند Biren و Moore Threads هدایت می شود، اکوسیستم نرم افزاری CUDA و معماری Hopper انویدیا به عنوان پیش فرض برای آموزش بزرگترین مدل های چینی باقی مانده است.
این وابستگی حتی زمانی که ایالات متحده در چند سال گذشته کنترل های صادراتی تراشه های هوش مصنوعی پیشرفته به چین را تشدید کرده است، ادامه دارد. H200 در مرکز این تنش قرار دارد: این یک GPU مرکز داده پرچمدار است که آزمایشگاههای غربی از جمله متا و xAI صدها هزار نفر از آن استفاده میکنند. اینکه چگونه خوشهای با آن اندازه برای مشتریان چینی از طریق واسطههای ابری در دسترس باقی میماند، احتمالاً نظارت دقیقی بر دسترسی رژیم کنترل صادرات بر محاسبات اجارهای و نه فروختهشده را تجدید میکند.
چه معنی برای Kimi K3
مقیاس محاسباتی به توضیح اینکه چگونه Moonshot توانست Kimi K3 را با چنین تعداد پارامتر بزرگ آموزش دهد کمک می کند. Kimi K3 به عنوان رقیبی برای مدلهای مرزی OpenAI و Anthropic قرار گرفته است و مونشات بر استدلال طولانی مدت و قابلیتهای عاملی بهعنوان متمایزکننده تأکید کرده است. یک خوشه 20000-H200، در حالی که کوچکتر از ابرخوشه هایی است که توسط متا یا xAI اداره می شوند، اما در میان تک ردپاهای آموزشی قابل توجهی است که توسط یک آزمایشگاه چینی فاش شده است.
برای در نظر گرفتن مقیاس، یک خوشه 20000 GPU با هر استانداردی بزرگ است، اما هنوز کسری از ابرخوشههایی است که توسط بزرگترین آزمایشگاههای غربی اداره میشوند. متا به طور علنی در مورد خوشه هایی با بیش از 100000 پردازنده گرافیکی صحبت کرده است، و تاسیسات "Colossus" xAI در ممفیس بسیار فراتر از آن ساخته شده است. برای یک استارتآپ به جای ابر مقیاسکننده که از طریق شریک اجارهای به 20000 شتابدهنده کلاس Hopper فرمان دهد، نشان میدهد که چگونه واسطههای ابری دسترسی به محاسبات مرزی را توزیع میکنند – و چگونه شکاف بین بودجه آموزشی چین و غرب ممکن است سریعتر از آنچه قوانین کنترل صادرات برای پیشبینی طراحی شده بودند، کاهش یابد.
مکاشفه همچنین در میان یک دوره آشفته برای مون شات فرود می آید. این شرکت اخیراً دور دوم جمع آوری کمک های مالی را متوقف کرده است و نظرات عمومی بنیانگذار لیانگ ونفنگ توجه ها را به خود جلب کرده است. دسترسی مطمئن به دهها هزار پردازنده گرافیکی پیشرفته از طریق شریکی مانند علیبابا، یکی از مهمترین محدودیتهای پیش روی هر استارتآپ مدل مرزی - محاسباتی - را برطرف میکند، حتی با وجود سؤالات در مورد بودجه و حاکمیت.
تصویر بزرگتر
قرارداد Moonshot-Alibaba واقعیت ساختاری مسابقه جهانی هوش مصنوعی در سال 2026 را نشان می دهد: شکاف بین مدلی که یک آزمایشگاه می تواند بسازد و سخت افزاری که می تواند ایمن کند کاهش یافته است، اما بسته نشده است. آزمایشگاههای چینی مدلهای رقابتی فزایندهای را ارائه میکنند، با این حال سیلیکون زیر آنها هنوز به طور مستقیم یا غیرمستقیم از همان زنجیره تامین Nvidia جریان مییابد که رقبای غربی آنها را قدرت میدهد. از آنجایی که محاسبات اجارهای ابری مرز بین مالکیت و دسترسی را محو میکند، جبهه بعدی در جنگ تراشهها ممکن است بر سر این باشد که چه کسی میتواند شتابدهندههای پیشرفته را اجاره کند – نه فقط اینکه چه کسی میتواند آنها را بخرد.
از هوش مصنوعی جلوتر بمانید
داستان سختافزاری به سرعت در حال پیشروی است. برای پوشش مداوم سیلیکون زیربنای هوش مصنوعی، AI Buzz Wire را نشانک بزنید.
اخبار سخت افزار هوش مصنوعی را بیشتر بخوانید →
