آزمایشگاه هوش مصنوعی چینی MiniMax رویکرد غیرمعمولی را برای آخرین نسخه خود در پیش گرفته است: به سختی آن را تأیید کرد. در 27 سپتامبر، حساب رسمی شرکت آنچه را که توسعه‌دهندگان قبلاً در این محصول مشاهده کرده بودند تأیید کرد - یک مدل جدید به نام M3.1-Flash-Preview در MiniMax Code، دستیار برنامه‌نویسی شرکت، منتشر شد. این میزان راه اندازی بود: بدون کارت مدل، بدون جدول معیار، بدون قیمت برای هر میلیون توکن.

طبق گفته Startup Fortune، ناظران چینی هوش مصنوعی در X متوجه شده بودند که این مدل قبل از تأیید در محصول ظاهر می شود. عرضه خاموش، تضاد قابل توجهی با نحوه عرضه آخرین پرچمدار خود مینی مکس دارد. For more context on this story, see our ongoing breaking AI news.

اولین نمایش عمدا آرام

هنگامی که MiniMax M3 را در ژوئن راه اندازی کرد، این شرکت جزئیات معماری، امتیازات SWE-bench و یک برگه قیمت گذاری را منتشر کرد که رقبای خود را 90% کاهش داد. این بار، نقطه پایانی API برای M3.1-Flash-Preview دریچه ای است، و تنها راه برای آزمایش مدل، داخل محصول خود MiniMax است، با ردپای استدلال و رفتار به عنوان سیگنال های اصلی قابل مشاهده.

استراتژی کم‌کلید نشان می‌دهد که MiniMax ممکن است این نسخه را کمتر شبیه یک راه‌اندازی سرفصل و بیشتر شبیه یک آزمایش باشد: A/B یک ویژگی محصول را آزمایش می‌کند و به اینترنت اجازه می‌دهد آن را پیدا کند. این می‌تواند نشان‌دهنده این اطمینان باشد که وقتی توسعه‌دهندگان از آن استفاده کنند، این مدل به خودی خود صحبت خواهد کرد - یا به سادگی این نسخه نسخه بزرگ نیست، بلکه یک ردیف همراه سریع‌تر و ارزان‌تر است.

آنچه پایگاه M3 به ما می گوید

مدل پایه M3 این حس را ارائه می دهد که مینی مکس می تواند در زمانی که توجه می خواهد ارائه دهد. این یک مدل ترکیبی از متخصصان با 428 میلیارد پارامتر با تقریباً 23 میلیارد پارامتر فعال در هر توکن، یک پنجره زمینه یک میلیون توکن و ورودی تصویر و ویدیوی بومی است. در SWE-bench Verified، MiniMax امتیاز 80.5% را گزارش کرد.

Flash نسخه خطی است که برای افزایش سرعت و مزیت قیمت برای کدنویسی روزمره ساخته شده است - رفع سریع باگ ها و توسعه دهندگان با ویژگی های کوچک ده ها بار در روز اجرا می شوند، به جای وظایف نمایندگی طولانی مدت که برای پرچمدار رزرو شده است. تقسیم یک خط مدل از این طریق، با یک نسخه مرزی بزرگ و یک همراه سریع و ارزان، به کتاب استاندارد در میان آزمایشگاه‌های چینی تبدیل شده است که برای اشتراک‌گذاری ذهن توسعه‌دهندگان رقابت می‌کنند.

ارسال به یک میدان شلوغ

MiniMax در بازاری آرام عرضه نمی شود. علی بابا Qwen3.8-Max را در 3 آگوست عرضه کرد - یک پرچمدار 2.4 تریلیون پارامتری با قیمت 2 دلار در هر میلیون توکن ورودی - سپس در 12 آگوست با اولین نسخه وزن باز مدل Max-tier Qwen عرضه شد. GLM-5.3 Zhipu در 14 آگوست با یک پنجره زمینه میلیون توکنی خودش فرود آمد.

توسعه دهندگان متوجه سیل گزینه های توانمند و ارزان شده اند. بر اساس گزارش CNBC در مورد داده‌های OpenRouter، مدل‌های چینی 57 تا 67 درصد از کل استفاده از توکن‌ها در این پلتفرم را در هفته منتهی به 14 سپتامبر به خود اختصاص دادند که از 6 درصد به 13 درصد در ماه فوریه افزایش یافته است. Vercel شاهد جهشی مشابه بود و سهم مدل‌های چینی از استفاده از پلتفرم خود در ماه آگوست به 55 درصد افزایش یافت.

واشنگتن در حال تماشا است

این افزایش توجه فراتر از جوامع توسعه دهندگان را به خود جلب کرده است. دانیل رملر، کارشناس ارشد برنامه فناوری و امنیت ملی در مرکز امنیت جدید آمریکا، به CNBC گفت که هوش مصنوعی چینی نشان دهنده "خطرات اقتصادی و امنیتی واقعی برای ایالات متحده است" و نسبت به ادغام مدل های چینی در جریان های کاری حیاتی هشدار داد.

این بررسی دقیق لایه‌ای از پیچیدگی را به انتشار بی‌صدا MiniMax اضافه می‌کند. مدلی که بدون کارت مدل، ارزیابی‌های منتشر شده یا قیمت‌گذاری ارائه می‌شود، به توسعه‌دهندگان مستقل کمتر اجازه می‌دهد تا هنگام ارزیابی کیفیت و ایمنی با آن کار کنند - حتی اگر محصولات آزمایشگاه در برابر رقبای آمریکایی سهم استفاده واقعی را به دست آورند.

چرا پرتاب آرام ممکن است استراتژیک باشد

مدل‌های پیش‌نمایش در داخل محصول خود یک شرکت یک الگوی آشنا هستند: آنها داده‌های استفاده و بازخورد را قبل از انتشار API گسترده‌تر تولید می‌کنند، در حالی که در صورت عملکرد ضعیف مدل، نوردهی را محدود می‌کنند. برای MiniMax، اولین خاموش M3.1-Flash-Preview ممکن است راهی برای جلب توجه برای یک راه اندازی بزرگتر باشد - طبق گزارش استارتاپ فورچون، این شرکت با آماده سازی یک مدل پرچمدار جدید، فروش بیش از دو برابری داشته است.

برای توسعه‌دهندگان، راهکار عملی ساده است: یک ردیف کدنویسی سریع جدید از یکی از آزمایشگاه‌های پیشرو چین، اکنون در MiniMax Code موجود است، و معیارها و قیمت‌هایی که معمولاً چنین نسخه‌ای را ارائه می‌کنند، هنوز وجود ندارند. اینکه آیا M3.1-Flash-Preview می‌تواند شتابی را که مدل‌های چینی حمل می‌کرد تا اکثریت ترافیک OpenRouter گسترش دهد، به نحوه عملکرد آن بستگی دارد که توسعه‌دهندگان شروع به انجام بارهای کاری واقعی از طریق آن کنند.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →