新闻宏观经济Moonshot AI 发布 Kimi K3 开放权重和基础设施

Moonshot AI 发布 Kimi K3 开放权重和基础设施

作者: The Decoder·

要点速览

  • Moonshot AI 已在 Hugging Face 发布 Kimi K3 的开放权重,并在 GitHub 发布其技术报告。
  • 此次发布包括注意力内核、MoE 通信库和用于大规模运行 AI Agent 的工具等配套基础设施。
  • Moonshot AI 表示,Kimi K3 的架构在每单位计算量上提供 2.5 倍的智能水平。
  • Kimi K3 在主要基准测试中的得分接近 Fable 5 和 GPT-5.6 Sol 等模型,同时据称运行成本略低。
  • 英国 Cyber Institute 的一项独立测试发现,Kimi K3 在网络能力和数学能力方面仍落后于前沿模型。
Moonshot AI 发布 Kimi K3 开放权重和基础设施

中国 AI 公司 Moonshot AI 已发布 Kimi K3 的模型权重和技术报告,这是其最新的开放权重 AI 模型。模型权重可在 Hugging Face 获取,技术报告可在 GitHub 获取。开放权重发布受到密切关注,因为它让外部开发者能够比仅通过封闭 API 的系统更直接地运行和调整模型,而技术报告则为研究人员评估训练选择、架构主张和局限性提供了依据。

除权重外,Moonshot AI 还开源了 Kimi K3 周边使用的部分基础设施。此次发布包括高性能注意力内核、一个 MoE 通信库,以及用于大规模运行 AI Agent 的工具。MoE,即专家混合架构,会将任务路由到专门的模型组件,因此相关通信和服务基础设施是现实效率的重要组成部分。Moonshot AI 表示,新架构在每单位计算量上的智能水平提升了 2.5 倍。

Kimi K3 于 2026 年 7 月中旬首次发布,并因在广受关注的基准测试中得分接近 Fable 5 和 GPT-5.6 Sol 等西方前沿模型而受到关注,同时据称运行成本略低,并且现在以开放权重形式提供。基准测试结果可以影响外界对模型的早期认知,但它们不能替代特定领域测试、安全评估,或生产约束下的部署性能验证。

不过,英国 Cyber Institute 的一项独立测试发现,Kimi K3 的网络能力仍远远落后于前沿模型。该模型在数学能力上也显示出类似差距。这些差距值得关注,因为网络和数学评估常被用于检验模型是否能够从广泛的语言任务泛化到更专业的推理和工具使用领域。

这些差距可能表明 Kimi K3 依赖蒸馏,这是一种让较小模型从更强大模型的输出中学习的训练技术。中国 AI 模型经常面临此类指控。与此同时,美国开放权重 AI 模型的倡导者越来越多地将蒸馏视为一种正当技术。接下来可能受到审视的重点,是外部开发者如何利用已发布的权重、报告和基础设施复现 Moonshot AI 的说法,以及独立评估是否会确认该模型在实际工作负载中的优势和不足。