IBM与Together AI签署2.4亿美元多年期协议,在IBM Cloud上部署Nvidia驱动的推理集群
要点速览
- •IBM承诺在多年内投入2.4亿美元,为Together AI提供部署在IBM Cloud上的专用Nvidia HGX B300推理集群。
- •采用Nvidia Spectrum-X以太网网络的B300系统计划于2027年第一季度开始运营。
- •Together AI目前每月通过其推理产品处理400万亿token,支持超过100万名开发者。
- •Together AI近期完成了8亿美元的C轮融资,估值达83亿美元,用于扩展其AI Native Cloud平台。
- •该协议反映了IBM Cloud通过为特定高增长AI客户提供专用GPU算力来与大型超大规模云服务商竞争的战略。

IBM已承诺与Together AI达成一项价值2.4亿美元的多年期协议,在IBM Cloud上构建专用Nvidia推理集群,两家公司于周二宣布了这一消息。该协议为这家开源AI供应商提供了大量企业级GPU算力,助力其进一步拓展大型企业客户。该协议也反映了AI基础设施支出更广泛的转变——随着AI应用在生产环境中的部署不断推进,对推理(即运行已训练模型以生成输出的过程)的需求也在同步增长。
HGX B300系统将于2027年初上线
根据签署的协议,IBM将在IBM Cloud内部部署一个大型Nvidia HGX B300系统集群。据IBM新闻稿显示,该硬件预计将于2027年第一季度上线。这一多年的交付周期突显了目前确保下一代GPU算力所需的较长规划周期,云服务提供商和AI公司在硬件出货之前便已提前锁定资源。
Together AI将利用该算力为开源模型提供推理服务。IBM表示,这是IBM Cloud上首个围绕B300构建的同等规模专用推理集群,采用Nvidia的Spectrum-X以太网网络进行连接。
Nvidia声称该配置可产生比上一代多30倍的"AI工厂产出",但这一数据尚未得到独立验证。
Together AI每月400万亿token将在IBM上运行
Together AI近期完成了8亿美元的C轮融资,估值达83亿美元,旨在扩展其所谓的AI Native Cloud。该公司成立于2022年,向希望基于开放、模块化AI技术栈而非封闭专有模型进行开发的企业出租云基础设施。这一市场定位使Together AI处于一个竞争格局中,其竞争对手既包括OpenAI和Anthropic等专有API提供商,也包括其他专注于开源的推理平台,企业用户需要在成本、控制权和性能之间权衡取舍。
据IBM的新闻稿显示,Together AI目前每月通过其推理产品处理400万亿token,支持超过100万名开发者。IBM集群将为Together AI计划的扩张提供基础设施平台。
Together AI首席执行官Vipul Ved Prakash表示,该协议使公司能够触达更多客户,而无需要求他们支付前沿模型的价格。
"企业希望获得最佳前沿模型的性能,却不想承担封闭模型的溢价,而这一切的前提是底层基础设施在大规模运行时既快速又可靠,"Prakash在新闻稿中表示。他补充说,该集群代表了"我们在推动开源AI成为企业首选方面的重大一步。"
IBM深化与Nvidia的合作以服务AI初创企业
对IBM而言,与Together AI的协议为其与Nvidia日益深化的合作关系增添了新的层面。IBM Cloud总经理Alan Peacock表示,此次部署响应了企业对智能体AI的需求,指出IBM和Nvidia正在"提供可扩展、经济高效的企业级AI基础设施",以加速Together AI的运营。该交易也表明IBM Cloud正努力通过为特定高增长AI客户提供专用GPU算力,在与大型超大规模云服务商争夺AI基础设施工作负载方面展开竞争。
Nvidia HPC和AI基础设施高级总监Dion Harris将AI工厂描述为正在变得与电力或电信一样不可或缺的基础设施。
IBM还指出,两家公司一直在GPU原生数据分析和非结构化数据提取方面展开合作。该合作伙伴关系还涵盖咨询服务,Together AI集群被定位为向大型企业和初创企业销售AI算力的更广泛战略的一部分。