OpenAI称其Jalapeño芯片在推理表现上优于英伟达GB300
要点速览
- •OpenAI表示,Jalapeño使用SemiAnalysis的InferenceX基准进行了测试,测试模型包括GPT-OSS 120B、DeepSeek的R1 670B和Moonshot AI的Kimi K2.5 1T。
- •公司称,Jalapeño每单位电力可完成1.5至1.9倍更多工作,响应速度比对比系统快1.7至3.6倍。
- •OpenAI表示,在需要更多来回交互的任务中,Jalapeño的优势扩大到2.1至4.1倍。
- •OpenAI表示,不计划出售或出租Jalapeño,其主要限制是数据中心电力,而非资金或机房空间。
- •该芯片预计将在2026年底前开始小规模部署,并在2027年逐步扩大,OpenAI将继续同时依赖英伟达和Cerebras以及自有硅片。

OpenAI已发布其首批关于Jalapeño的基准测试结果。Jalapeño是该公司与Broadcom合作打造的自研推理芯片。
OpenAI表示,这款芯片每瓦可完成更多AI工作,且给出答案的速度快于英伟达的GB200和GB300机架系统,这些系统是测试中的对比对象。
借助Jalapeño,OpenAI加入了其他大型AI运营商的行列——Google有Tensor Processing Units,Amazon有Trainium芯片,Microsoft有Maia加速器,Meta有MTIA——随着行业推理成本上升,这些公司都在设计自有AI硅片。
OpenAI如何描述Jalapeño的表现
OpenAI表示,Jalapeño通过了InferenceX的评估。InferenceX是SemiAnalysis推出的公开基准,用于衡量提供AI请求服务的完整流程。该芯片在OpenAI自家的GPT-OSS 120B、DeepSeek的R1 670B以及Moonshot AI的Kimi K2.5 1T上进行了测试。
据OpenAI称,Jalapeño在该基准中每单位电力完成的工作量是其他系统的1.5至1.9倍。它返回结果的速度也快了1.7至3.6倍。
对于需要更多来回交互的任务,OpenAI表示优势扩大到2.1至4.1倍。
OpenAI硬件副总裁Richard Ho对记者表示,这款芯片能够同时处理更多工作,也能更快响应,而他称大多数芯片无法同时做到这两点。
对比对象是英伟达的GB200和GB300超级芯片,它们当时是InferenceX记录中的最佳结果。对于测试中最大的模型Kimi K2.5,OpenAI表示Jalapeño的峰值每瓦性能约高出1.5倍,延迟低3.4倍。
OpenAI还表示,没有租赁市场、没有实例类型,也没有出售Jalapeño的计划。这与Amazon和Google等云服务提供商不同,后者会向外部客户出租自家的定制芯片。当被问及公司是否会向其他人提供该芯片时,Ho表示OpenAI正“在努力争取足够的”算力满足自身需求。
Ho说,OpenAI拥有所需的预算和机房空间,但目前受限于数据中心供电,而不是资金或物理空间,因此每兆瓦可产生的tokens数量才是关键指标。对于整个数据中心建设行业来说,可用电力已成为门槛因素,电网容量正越来越多地决定AI基础设施能够多快建成。由于推理在ChatGPT和API中持续运行,OpenAI规模下每个token节省的瓦数都会迅速累积。
该芯片额定功耗为700瓦,但在测试工作负载中被控制在550瓦或以下。
这款硬件也符合OpenAI在2025年10月与Broadcom达成的协议,该协议将部署10吉瓦由OpenAI设计的加速器,持续到2029年。Cryptopolitan此前曾报道过这一合作最初的构想。
OpenAI的部署计划
在年度半导体工程会议Hot Chips上,Ho表示OpenAI将以每128颗芯片为一组部署Jalapeño,而完整pod将使用2,048颗ASIC。他说,128芯片部署可提供1.7 exaflops的4-bit算力和27.5 TB的HBM4,每个封装提供15.4 TB/s的内存带宽。
OpenAI表示,公司使用自有模型加速开发,从设计到tape-out仅用了九个月,这一速度远快于芯片开发通常需要的多年周期。Ho还表示,第二代版本“已深入开发”,第三代版本的工作也已开始。
尽管有这些基准表现,OpenAI并不会替换其GPU机群。Ho将Jalapeño描述为更广泛算力策略中的一部分,该策略仍依赖于英伟达和Cerebras这两家“非常、非常好的合作伙伴”。据报道,这款芯片将在2026年底前小规模部署,并在2027年逐步扩大规模。
值得注意的是,所有数字都来自OpenAI;SemiAnalysis亲自验证了InferenceX运行情况,但没有跑完整套测试,也没有查看AgentX的结果。
如果你读到这里,你已经领先一步。继续保持,订阅我们的新闻通讯。