آزمایشگاه هوش مصنوعی چینی MiniMax رویکرد غیرمعمولی را برای آخرین نسخه خود در پیش گرفته است: به سختی آن را تأیید کرد. در 27 سپتامبر، حساب رسمی شرکت آنچه را که توسعهدهندگان قبلاً در این محصول مشاهده کرده بودند تأیید کرد - یک مدل جدید به نام M3.1-Flash-Preview در MiniMax Code، دستیار برنامهنویسی شرکت، منتشر شد. این میزان راه اندازی بود: بدون کارت مدل، بدون جدول معیار، بدون قیمت برای هر میلیون توکن.
طبق گفته Startup Fortune، ناظران چینی هوش مصنوعی در X متوجه شده بودند که این مدل قبل از تأیید در محصول ظاهر می شود. عرضه خاموش، تضاد قابل توجهی با نحوه عرضه آخرین پرچمدار خود مینی مکس دارد. For more context on this story, see our ongoing breaking AI news.
اولین نمایش عمدا آرام
هنگامی که MiniMax M3 را در ژوئن راه اندازی کرد، این شرکت جزئیات معماری، امتیازات SWE-bench و یک برگه قیمت گذاری را منتشر کرد که رقبای خود را 90% کاهش داد. این بار، نقطه پایانی API برای M3.1-Flash-Preview دریچه ای است، و تنها راه برای آزمایش مدل، داخل محصول خود MiniMax است، با ردپای استدلال و رفتار به عنوان سیگنال های اصلی قابل مشاهده.
استراتژی کمکلید نشان میدهد که MiniMax ممکن است این نسخه را کمتر شبیه یک راهاندازی سرفصل و بیشتر شبیه یک آزمایش باشد: A/B یک ویژگی محصول را آزمایش میکند و به اینترنت اجازه میدهد آن را پیدا کند. این میتواند نشاندهنده این اطمینان باشد که وقتی توسعهدهندگان از آن استفاده کنند، این مدل به خودی خود صحبت خواهد کرد - یا به سادگی این نسخه نسخه بزرگ نیست، بلکه یک ردیف همراه سریعتر و ارزانتر است.
آنچه پایگاه M3 به ما می گوید
مدل پایه M3 این حس را ارائه می دهد که مینی مکس می تواند در زمانی که توجه می خواهد ارائه دهد. این یک مدل ترکیبی از متخصصان با 428 میلیارد پارامتر با تقریباً 23 میلیارد پارامتر فعال در هر توکن، یک پنجره زمینه یک میلیون توکن و ورودی تصویر و ویدیوی بومی است. در SWE-bench Verified، MiniMax امتیاز 80.5% را گزارش کرد.
Flash نسخه خطی است که برای افزایش سرعت و مزیت قیمت برای کدنویسی روزمره ساخته شده است - رفع سریع باگ ها و توسعه دهندگان با ویژگی های کوچک ده ها بار در روز اجرا می شوند، به جای وظایف نمایندگی طولانی مدت که برای پرچمدار رزرو شده است. تقسیم یک خط مدل از این طریق، با یک نسخه مرزی بزرگ و یک همراه سریع و ارزان، به کتاب استاندارد در میان آزمایشگاههای چینی تبدیل شده است که برای اشتراکگذاری ذهن توسعهدهندگان رقابت میکنند.
ارسال به یک میدان شلوغ
MiniMax در بازاری آرام عرضه نمی شود. علی بابا Qwen3.8-Max را در 3 آگوست عرضه کرد - یک پرچمدار 2.4 تریلیون پارامتری با قیمت 2 دلار در هر میلیون توکن ورودی - سپس در 12 آگوست با اولین نسخه وزن باز مدل Max-tier Qwen عرضه شد. GLM-5.3 Zhipu در 14 آگوست با یک پنجره زمینه میلیون توکنی خودش فرود آمد.
توسعه دهندگان متوجه سیل گزینه های توانمند و ارزان شده اند. بر اساس گزارش CNBC در مورد دادههای OpenRouter، مدلهای چینی 57 تا 67 درصد از کل استفاده از توکنها در این پلتفرم را در هفته منتهی به 14 سپتامبر به خود اختصاص دادند که از 6 درصد به 13 درصد در ماه فوریه افزایش یافته است. Vercel شاهد جهشی مشابه بود و سهم مدلهای چینی از استفاده از پلتفرم خود در ماه آگوست به 55 درصد افزایش یافت.
واشنگتن در حال تماشا است
این افزایش توجه فراتر از جوامع توسعه دهندگان را به خود جلب کرده است. دانیل رملر، کارشناس ارشد برنامه فناوری و امنیت ملی در مرکز امنیت جدید آمریکا، به CNBC گفت که هوش مصنوعی چینی نشان دهنده "خطرات اقتصادی و امنیتی واقعی برای ایالات متحده است" و نسبت به ادغام مدل های چینی در جریان های کاری حیاتی هشدار داد.
این بررسی دقیق لایهای از پیچیدگی را به انتشار بیصدا MiniMax اضافه میکند. مدلی که بدون کارت مدل، ارزیابیهای منتشر شده یا قیمتگذاری ارائه میشود، به توسعهدهندگان مستقل کمتر اجازه میدهد تا هنگام ارزیابی کیفیت و ایمنی با آن کار کنند - حتی اگر محصولات آزمایشگاه در برابر رقبای آمریکایی سهم استفاده واقعی را به دست آورند.
چرا پرتاب آرام ممکن است استراتژیک باشد
مدلهای پیشنمایش در داخل محصول خود یک شرکت یک الگوی آشنا هستند: آنها دادههای استفاده و بازخورد را قبل از انتشار API گستردهتر تولید میکنند، در حالی که در صورت عملکرد ضعیف مدل، نوردهی را محدود میکنند. برای MiniMax، اولین خاموش M3.1-Flash-Preview ممکن است راهی برای جلب توجه برای یک راه اندازی بزرگتر باشد - طبق گزارش استارتاپ فورچون، این شرکت با آماده سازی یک مدل پرچمدار جدید، فروش بیش از دو برابری داشته است.
برای توسعهدهندگان، راهکار عملی ساده است: یک ردیف کدنویسی سریع جدید از یکی از آزمایشگاههای پیشرو چین، اکنون در MiniMax Code موجود است، و معیارها و قیمتهایی که معمولاً چنین نسخهای را ارائه میکنند، هنوز وجود ندارند. اینکه آیا M3.1-Flash-Preview میتواند شتابی را که مدلهای چینی حمل میکرد تا اکثریت ترافیک OpenRouter گسترش دهد، به نحوه عملکرد آن بستگی دارد که توسعهدهندگان شروع به انجام بارهای کاری واقعی از طریق آن کنند.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →