中国人工智能实验室MiniMax对其最新版本采取了不同寻常的态度:它几乎不承认这一点。 9 月 27 日,该公司的官方账号证实了开发人员已经在该产品中发现的内容——名为 M3.1-Flash-Preview 的新模型已在该公司的编码助手 MiniMax Code 中上线。这就是发行的范围:没有模型卡,没有基准表,没有每百万代币的价格。
据 Startup Fortune 报道,X 上的中国人工智能观察者在确认之前就注意到该模型出现在产品中。低调的推出与 MiniMax 推出其最后一款旗舰产品的方式形成鲜明对比。 更多相关背景,请参阅我们的人工智能资讯。
刻意安静的首次亮相
当 MiniMax 在 6 月推出 M3 时,该公司公布了架构细节、SWE 基准分数和定价表,比竞争对手低了 90%。这次,M3.1-Flash-Preview 的 API 端点被门控,尝试该模型的唯一方法是在 MiniMax 自己的产品内部,以推理轨迹和行为作为主要可观察信号。
这种低调的策略表明,MiniMax 可能不会将此次发布视为一次头条新闻,而更像是一次实验:对产品功能进行 A/B 测试,然后让互联网来发现答案。这可能反映出人们相信,一旦开发人员使用该模型,它就会不言自明——或者只是表明这个版本不是大版本,而是更快、更便宜的配套版本。
Base M3 告诉我们什么
基础 M3 模型让人们了解 MiniMax 在需要关注时可以提供什么。它是一个包含 4280 亿个参数的专家混合模型,每个令牌大约有 230 亿个活动参数、一个包含 100 万个令牌的上下文窗口以及本机图像和视频输入。在 SWE-bench Verified 上,MiniMax 的得分为 80.5%。
Flash 是该系列的一个版本,旨在增强日常编码的速度和价格优势 - 快速错误修复和小功能工作开发人员每天运行数十次,而不是为旗舰保留的长期代理任务。以这种方式分割模型线,推出大型前沿版本和快速、廉价的伴侣,已成为中国实验室争夺开发者心智份额的标准策略。
运送到拥挤的领域
MiniMax 并没有进入平静的市场。阿里巴巴于 8 月 3 日推出了 Qwen3.8-Max,这是一款 2.4 万亿参数的旗舰产品,售价为每百万输入代币 2 美元,随后于 8 月 12 日推出了 Max-tier Qwen 模型的第一个开放权重版本。智浦的 GLM-5.3 于 8 月 14 日登陆,拥有自己的百万代币上下文窗口。
开发人员已经注意到大量功能强大、价格低廉的选择。根据 CNBC 对 OpenRouter 数据的报道,包括 9 月 14 日在内的一周,中国型号占该平台代币使用总量的 57% 至 67%,而 2 月份仅为 6% 至 13%。 Vercel 也出现了类似的增长,8 月份中国模特在其平台上的使用份额上升至 55%。
华盛顿正在关注
这种激增引起了开发者社区之外的广泛关注。新美国安全中心技术和国家安全项目高级研究员丹尼尔·雷姆勒 (Daniel Remler) 向 CNBC 表示,中国人工智能代表着“美国真正的经济和安全风险”,并警告不要将中国模式整合到关键工作流程中。
这种审查给 MiniMax 的悄然发布增加了一层复杂性。如果模型没有模型卡、已发布的评估或定价,那么独立开发商在评估质量和安全性时就会减少合作的机会——即使该实验室的产品相对于美国竞争对手获得了实际的使用份额。
为什么悄然推出可能是战略性的
公司自己的产品内部的预览模型是一种熟悉的模式:它们在更广泛的 API 发布之前生成使用数据和反馈,同时在模型表现不佳时限制曝光。对于 MiniMax 来说,M3.1-Flash-Preview 的低调亮相也可能是为更大规模的发布吸引眼球的一种方式——根据 Startup Fortune 援引的报道,该公司在准备新旗舰机型时销售额增加了一倍多。
对于开发人员来说,实际的收获很简单:来自中国领先实验室之一的新快速编码层现已在 MiniMax Code 中运行,而通常构建此类版本的基准和定价仍然缺失。 M3.1-Flash-Preview 是否能够扩大中国模型在 OpenRouter 流量中占据多数份额的势头,将取决于开发人员开始通过它推动实际工作负载后它的表现如何。
---
掌握AI最新动态获取最新的AI新闻、分析和突破——尽在一处。
阅读更多AI新闻 →