中国Kimi K3在关键基准测试中追平美国AI模型,但硬件差距揭示不同故事

总部位于北京的Moonshot AI于7月16日发布了Kimi K3,AI研究人员的反应迅速而热烈。”人们称之为’斯普特尼克时刻’,”新南威尔士大学认知神经科学家、研究AI对社会影响的乔尔·皮尔森(Joel Pearson)表示,”这是一个转折点。”

Kimi K3是一个拥有2.8万亿参数的推理模型,是有史以来公开发布的最大型AI模型之一。Moonshot的内部基准测试显示,该模型在编程、电子表格操作和通用推理任务上与美国的顶级模型旗鼓相当,甚至更胜一筹。发布三天后,需求就将该公司的处理能力推至极限,迫使暂停新用户注册。

但K3背后的故事不仅仅是基准测试分数,更关乎在美国芯片禁运下构建前沿AI模型的意义。

以少胜多

自2022年10月以来,美国以国家安全为由限制中国获取先进AI芯片。这些限制措施一再收紧,最近一次是在2025年,拜登政府将管制范围扩大至包括某些类型的内存带宽和芯片封装。

中国企业的回应是在算法效率方面大力投入。2025年初发布的DeepSeek证明,可以用比美国公司更少、更不先进的芯片构建具有竞争力的模型。Kimi K3延续了这一轨迹。

新南威尔士大学计算机科学家托比·沃尔什(Toby Walsh)表示,芯片限制可能无意中加速了中国在模型架构方面的创新。”可以推测,这里需求是发明之母。”

K3的规模、2.8万亿参数,在训练过程中需要相当可观的硬件支持。但Moonshot AI并未披露其训练基础设施或总计算预算。开放权重的发布允许研究人员在自己的硬件上运行该模型,这有可能实现闭源、仅限API的模型无法实现的应用。

模型访问的地缘政治

K3的发布恰逢AI模型可用性异常波动的时期。2026年6月,美国政府指示Anthropic暂时禁用其最先进的模型Fable 5和Mythos 5。Fable 5的访问权限在数周后恢复,但Mythos 5仍仅限于特定美国组织使用。

这创造了一种市场动态:开放权重的中国模型可能是美国以外研究人员能够获得的唯一前沿级模型。皮尔森指出,中国模型正在改变”投资者和用户对美国前沿模型价值的看法”,因为Google、Anthropic和OpenAI花费数十亿美元训练的模型可能在一天之内变得无法访问。

K3的局限性

模型的规模也是其限制因素。一个2.8万亿参数的模型即使仅用于推理也需要大量的内存和计算资源。硬件有限的研究人员可能会发现,与更小、更高效的模型相比,K3并不实用。Moonshot尚未披露推理成本或硬件要求,潜在用户只能自行评估该模型的能力是否值得其资源消耗。

中国模型是否真正缩小了与美国前沿模型的差距,这个更广泛的问题仍然难以客观回答。公开基准测试涵盖特定任务,且存在过拟合的风险。性能最强的美国模型(OpenAI的GPT-5.6、Anthropic的Claude Opus 4)尚未发布足够详细的技术报告以进行独立比较。K3可能是世界上最好的开放权重模型,但它是否是最好的模型,取决于最优秀的闭源模型的能力有多少仍然不为公开评估所见。

婷 翻译

Sources

Fieldhouse, R. & Basu, M. (2026). “Does China’s latest AI model finally equal US rivals? What scientists think.” Nature News, 7月21日. DOI: 10.1038/d41586-026-02281-2; Reuters (2026), “China’s Moonshot unveils world’s largest open AI model”; Bloomberg (2026), “Moonshot Unveils Kimi K3.”

Scroll to Top