根据彭博社 2026 年 7 月 31 日发布的一份报告,Moonshot AI 是 Kimi 系列大型语言模型背后的中国初创公司,一直在约 20,000 个 Nvidia H200 芯片 的集群上运行其最先进的系统,这些芯片是通过与阿里巴巴达成的计算能力协议提供的。该披露罕见地展示了中国最受关注的人工智能实验室之一背后的巨大计算能力,并强调了该国的前沿模型仍然如何依赖于西方半导体。
据彭博社援引接近 Moonshot 的人士称,这些芯片是 H200 处理器,这是 Nvidia 最先进的 Hopper 一代加速器。该集群是从阿里巴巴集团控股公司租用的,为 Moonshot 的 Kimi 模型提供了很大一部分计算能力,其中包括 Kimi K3,该公司将其扩展到大约 2.8 万亿个参数。如需持续报道推动人工智能发展的硬件竞赛,请关注我们的最新人工智能新闻。
云计算安排,而不是芯片所有权
该交易的结构是计算能力协议,而不是直接购买硬件,这意味着Moonshot实际上租用了阿里巴巴的Nvidia产能。彭博社报道称,20,000 个芯片集群占据了 Kimi 模型背后计算能力的“关键部分”,并建议 Moonshot 通过自己的额外容量来补充这一分配。
这一安排凸显了中国人工智能领域的一种新兴模式:阿里巴巴和腾讯等云巨头充当计算经纪人,将先进的加速器容量出租给较小的模型构建者,而不是每家初创公司都积累自己的 GPU 库存。对于今年早些时候估值约为 35 亿美元的 Moonshot 来说,租赁而不是购买降低了训练前沿规模模型的资本障碍。
中国对 Nvidia 的持续依赖
据了解两家公司运营情况的人士透露,彭博社的报告明确将该交易视为“中国继续依赖西方半导体来推动人工智能发展”的证据。尽管华为 Ascend 系列以及 Biren 和 Moore Threads 等初创公司引领了国内芯片的大规模发展,但 Nvidia 的 CUDA 软件生态系统和 Hopper 架构仍然是训练最大的中国模型的默认选择。
尽管美国在过去几年加强了对中国先进人工智能芯片的出口管制,但这种依赖仍然存在。 H200 处于这种紧张局势的中心:它是一款旗舰数据中心 GPU,包括 Meta 和 xAI 在内的西方实验室有数十万人使用它。中国客户如何通过云中介机构访问如此规模的集群,可能会重新审视出口管制制度对租赁而非出售计算的影响力。
这对 Kimi K3 意味着什么
计算规模有助于解释 Moonshot 如何能够将 Kimi K3 训练到如此大的参数数量。 Kimi K3 被定位为 OpenAI 和 Anthropic 前沿模型的竞争对手,而 Moonshot 则强调长上下文推理和代理能力作为差异化因素。一个 20,000-H200 的集群虽然比 Meta 或 xAI 运营的超级集群要小,但却是中国实验室披露的更实质性的单一训练足迹之一。
从规模来看,20,000 个 GPU 的集群无论以任何标准来看都很大,但仍然只是西方最大实验室运营的超级集群的一小部分。 Meta 公开谈论过超过 100,000 个 GPU 的集群,而 xAI 位于孟菲斯的“Colossus”设施的建设远远超出了这个数字。对于一家初创公司而不是超大规模企业来说,通过租赁合作伙伴控制 20,000 个 Hopper 级加速器说明了云中介机构如何重新分配前沿计算的访问权限,以及中国和西方培训预算之间的差距如何缩小得比出口管制规则预期的更快。
这一启示也发生在登月计划的动荡时期。该公司近期暂停了第二轮融资,创始人梁文峰的公开言论引发关注。通过阿里巴巴这样的合作伙伴确保对数以万计的高端 GPU 的可靠访问,解决了任何前沿模式初创公司面临的最紧迫的限制之一——计算——即使资金和治理问题仍然存在。
大局观
Moonshot 与阿里巴巴的交易说明了 2026 年全球人工智能竞赛的结构性现实:实验室可以构建的模型与其可以保护的硬件之间的差距已经缩小,但尚未缩小。中国实验室正在提供越来越有竞争力的模型,但它们背后的芯片仍然直接或间接地来自为西方竞争对手提供动力的同一个英伟达供应链。随着云租用计算模糊了所有权和访问权之间的界限,芯片战争的下一个战线可能会围绕谁可以租赁先进的加速器而展开,而不仅仅是谁可以购买它们。
保持人工智能领先地位
从数据中心大宗交易到为前沿模型提供动力的芯片,硬件故事正在快速发展。为 AI BuzzWire 添加书签,了解支持人工智能的硅芯片的持续报道。
阅读更多人工智能硬件新闻 →
