Nvidia 支持的 Reflection AI 发布其首个开源模型 Beam,能否成为美国对抗中国 AI 领先地位的最好机会?
要点速览
- •获得 Nvidia 支持、估值 250 亿美元的纽约初创公司 Reflection 发布了其首个开源 AI 模型 Beam,旨在与 Moonshot 的 Kimi K3 和 DeepSeek 的 V4 等中国主导的开源模型竞争。
- •在 Reflection 的内部基准测试中,Beam 的得分与总部位于北京的 Z.ai 的 GLM-5.2 相近,后者于 7 月发布、随后被 GLM-5.3 接替。
- •Reflection 称 Beam 的效率是西方公司竞品开源模型的三到四倍,以极低的 token 成本和推理时算力在编程和智能体任务上提供有竞争力的表现。
- •在发布之前,Reflection 已获得 5 月向美国政府两个部门供应模型的合作伙伴关系、与 SpaceX 的 63 亿美元算力协议以及与 Nebius 的 10 亿美元协议,两个月内合计锁定超过 70 亿美元的算力。
- •OpenRouter 上基于真实使用情况的排名目前将中国厂商和 Nvidia 位列开源模型排行榜前列,而 Reflection 表示已在训练路线图上规模更大的下一个模型。

在打造全球最佳开源 AI 模型的竞赛中,美国迎来了新的竞争者——这项竞赛目前由中国主导,热门模型包括 Moonshot 的 Kimi K3 和 DeepSeek 的 V4。
总部位于纽约市的 AI 公司 Reflection 发布了其首个模型 Beam。该公司告诉 Fortune,Beam "推动了西方开放生态的前沿"。
在公司自行进行的基准测试中,Beam 取得了与 GLM-5.2 相近的得分。GLM-5.2 是总部位于北京的 Z.ai 于 7 月发布的开源模型,随后 Z.ai 在 8 月推出了其继任者 GLM-5.3。
Reflection 表示,Beam 的运行成本低于许多竞品模型。"通过高算力强化学习,我们使 Beam 的推理极为高效——以极低的 token 成本和推理时算力,在编程和智能体任务上提供有竞争力的表现,"该公司称。Reflection 补充说,Beam 的效率是西方公司同类开源模型的三到四倍,并将其定位为面向企业、公共部门和开发者的"主力"模型。经济性是这一卖点核心:由于部署开源模型的组织需自行承担计算成本,token 成本和推理时算力的节省会直接转化为运营开支的下降。
此次发布之前,Reflection 已达成一系列备受瞩目的合作与算力协议。今年 5 月,该公司达成一项合作伙伴关系,向美国能源部和美国战争部供应其模型。6 月,据 CNBC 报道,它与 SpaceX 签署了一项 63 亿美元的算力协议,以获取后者 Colossus 2 数据中心的 Nvidia GB300 芯片。7 月,它又通过云服务商 Nebius 追加了一项 10 亿美元的算力协议,Bloomberg 报道。这两项算力协议合计超过 70 亿美元,在两个月内敲定。
Reflection 由前 Google DeepMind 研究人员 Misha Laskin(现任 CEO)和 Ioannis Antonoglou(现任总裁兼首席技术官)于 2024 年 3 月创立。Laskin 4 月告诉 CNBC,这家获得 Nvidia 支持的公司估值为 250 亿美元。
最知名的 AI 公司——OpenAI、Anthropic 和 Google DeepMind——推出的模型主要通过称为 API 的接口供客户使用,即提交提示并接收响应。相比之下,开源模型可由用户完整下载,在自己的硬件或云基础设施上运行,并以方式进行微调或修改。越来越多的大型企业正转向这些开源模型,因为它们在数据安全和成本方面提供了更强的控制力,尽管这些模型的性能在很多情况下仍落后于专有系统。
"开放系统进化更快,吸引更广泛的参与,并培育出任何单一组织都无法独立实现的研究与创新生态系统,"该公司网站上的使命宣言写道。"它们也更安全:当系统对外开放审查时,更多研究者能够发现漏洞、改进安全防护,并为其长期韧性做出贡献。"
与 Reflection 最具可比性的西方公司可能是 Thinking Machines Lab,由 OpenAI 前首席技术官 Mira Murati 创立。该公司于 7 月发布了其首个模型 Inkling。Nvidia 也有一款名为 Nemotron 的开源模型,OpenAI、Google 和 Meta 同样提供开源模型。
在 OpenRouter 的大语言模型(LLM)排行榜上,Nvidia 的 Nemotron 是排名最高的美国模型,截至发稿位列第 6。OpenRouter 是一个连接用户与多个路由的网关,并追踪哪些模型使用量最大。按开源模型筛选时,排行榜前列的模型来自 DeepSeek、Z.ai、小米、腾讯和 Nvidia。OpenAI 的 gpt-oss 模型是排名次高的美国模型,位列第 19。与 Reflection 的内部基准测试不同,这些排名基于真实使用情况,在 Beam 面向用户之际为其提供了一个独立的参照。
Reflection 表示,公司"已在训练路线图上的下一个、规模更大的模型"。
本文最初发表于 Fortune.com。