美国网络评估显示 Moonshot AI 的 Kimi K3 落后于顶尖美国 AI 模型
要点速览
- •Kimi K3 在 ExploitBench 上得分 32%,领先中国的 GLM-5.2,但远低于领先美国模型约 76% 的成绩。
- •在一项模拟 32 步企业网络攻击的测试中,Kimi K3 平均到达第 17 步,并在 10 次尝试中完整完成序列 1 次。
- •该评估存在限定条件,因为 Kimi K3 只接受了部分测试,而美国模型是在关闭安全过滤器的情况下接受评估。
- •CAISI 表示,Kimi K3 的防护机制未能阻止其尝试构建黑客工具或攻击系统。
- •华盛顿指控 Moonshot 通过蒸馏复制 Anthropic 的 Claude Fable 5,Anthropic 支持这一说法。

美国政府对中国最新 AI 模型进行了网络安全评估,并得出结论称,Moonshot AI 的 Kimi K3 明显落后于最优秀的美国模型。
美国机构 Center for AI Standards and Innovation(CAISI)与一家英国合作方共同实施了测试。结果公布前一天,华盛顿刚指控 Moonshot 使用被窃取的美国技术构建 Kimi K3。攻击性网络能力已成为美国和英国 AI 安全评估中的重点领域,因为各国政府正在评估前沿模型是否可能自动化完成目前仍需要熟练人工操作员执行的黑客任务。
Kimi K3 在美国网络基准测试中落后
美国商务部于周四公布了调查结果,称基于与英国专家的联合评估,Kimi K3 的排名远低于顶尖美国模型。
CAISI's latest blog post evaluates Kimi K3 and its cyber capabilities. Based on a preliminary cyber-focused evaluation, Kimi K3 performed significantly below the leading U.S. frontier AI models. — U.S. Department Commerce (@CommerceGov) July 23, 2026
Moonshot 于 July 16 推出 Kimi K3。需求之高使该公司不得不在两天内暂停新用户注册。此次发布也冲击了美国芯片股,并引发了外界对美国在全球 AI 竞赛中地位的新疑问。
一项名为 ExploitBench 的基准测试使用由 Carnegie Mellon University 开发的真实 Chrome 浏览器漏洞。Kimi K3 得分为 32%,高于中国的 GLM-5.2 的 24%,但低于领先美国模型约 76% 的成绩。
最困难的步骤是完全控制目标机器。Kimi K3 在全部 41 次测试中均未能完成该步骤,而表现最好的美国模型成功了 20 次。
第二项测试名为 The Last Ones,模拟对一个包含 32 个步骤的虚构企业网络发起攻击。人类专家通常需要约 20 小时才能完成。Kimi K3 平均到达第 17 步,而顶尖美国模型到达第 28.5 步。Kimi K3 在 10 次尝试中仅完整完成整个序列 1 次,而据称表现最好的美国系统完成了 6 或 7 次。
差距可能看起来比实际更大
不过,数字并不能说明全部情况。报告自身的细则中包含多项限定条件。
首先,美国模型是在关闭安全过滤器的情况下接受测试的,这种设置会展现其全部能力。公开版本会保持这些过滤器开启,这意味着美国模型的得分代表的是最佳情形,而非现实环境中的表现。
评估团队还将这项工作描述为早期且有限。Kimi K3 只在一项测试中被评分,而且完整测试套件仅运行了一部分,因此其评级存在不确定性。部分测试也是私有的,这意味着独立观察者无法验证结果。
这种比较还存在根本性不匹配。Kimi K3 是任何人都可以下载的开放模型,而美国模型则是封闭的专有系统。英国研究机构此前发现,开放模型通常比最好的闭源模型落后 4 到 7 个月。CAISI 表示,只有在 Moonshot 向公众发布 Kimi K3 后,才会对其进行完整测试。
此外,这些测试并不是真实攻击。模拟网络中没有人类防御者,也没有会被触发的警报。即便如此,Kimi K3 仍超过了此前最强的开放模型,并且确实完整完成过一次攻击链。
测试时机和机构背景也引发疑问。CAISI 前身为 US AI Safety Institute,随后 Trump 政府于 June 2025 将其更名。它隶属于同一个限制美国芯片对华销售的部门。其关于一家中国竞争对手的报告,在盗窃指控提出后仅一天便发布。
薄弱防护引发担忧
不过,低分并不一定意味着 Kimi K3 是安全的。测试发现,其防护机制未能阻止模型尝试构建黑客工具或攻击系统。
考虑到接下来可能发生的情况,这一发现具有重要意义。Moonshot 计划于 July 27 发布完整模型。一旦发布,便无法召回——任何人都可以下载它并移除安全过滤器。开放权重发布的不可逆性已成为美国政策辩论中的核心议题,即强大的模型是否应受到发布限制;随着中国实验室在美国先进芯片出口管制下仍不断发布具备能力的开放模型,这一讨论也愈发激烈。
该评估也发生在一项盗窃指控之后。华盛顿称 Moonshot 基于被窃取的美国 AI 技术构建了 Kimi K3。白宫科技负责人 Michael Kratsios 表示,该公司通过一种名为蒸馏的技术秘密复制了 Anthropic 的 Claude Fable 5;这种技术通过使用更强模型的输出来训练新模型。
Anthropic 支持这一说法。今年 February,该公司通过数百个虚假账户追踪到超过 3.4 million 次 Claude 聊天与 Moonshot 有关。Anthropic 警告称,被复制的模型会失去原模型的安全控制——这正是本次测试识别出的同一漏洞。
美国在 AI 上的支出仍是中国的 23 倍,但中国实验室继续缩小差距。最终评估将出现在 Kimi K3 面向公众发布、独立专家能够自行检验相关说法之后。