IBM 與 Together AI 簽署 2.4 億美元多年期協議,於 IBM Cloud 建構 Nvidia 驅動的推論叢集
重點速覽
- •IBM 承諾在多年內投入 2.4 億美元,為 Together AI 提供託管於 IBM Cloud 的專用 Nvidia HGX B300 推論叢集。
- •配置 Nvidia Spectrum-X 乙太網路的 B300 系統預計於 2027 年第一季開始營運。
- •Together AI 目前每月透過其推論產品處理 400 兆個 token,並支援超過 100 萬名開發者。
- •Together AI 近期以 83 億美元的估值完成了 8 億美元的 C 輪融資,用於擴展其 AI Native Cloud 平台。
- •該協議反映了 IBM Cloud 透過提供與特定高成長 AI 客戶綁定的專用 GPU 容量,與大型超規模供應商競爭的策略。

IBM 已承諾與 Together AI 簽署一項為期多年、價值 2.4 億美元的協議,在 IBM Cloud 上建構專用的 Nvidia 推論叢集,兩家公司於週二宣布。該協議為這家開源 AI 供應商提供大量企業級 GPU 運算容量,協助其進一步拓展大型企業客戶市場。此協議也反映了 AI 基礎設施支出的更廣泛趨勢——隨著 AI 應用在生產環境中的部署日益增加,對推論(即運行已訓練模型以生成輸出的過程)的需求也同步成長。
HGX B300 系統預計於 2027 年初上線
根據簽署的協議,IBM 將在 IBM Cloud 內部署大規模的 Nvidia HGX B300 系統叢集。根據 IBM 新聞室公告,硬體預計於 2027 年第一季上線。這一多年的前置時間凸顯了目前確保次世代 GPU 容量所需的漫長規劃週期,雲端供應商和 AI 公司在硬體出貨前即提前鎖定資源。
Together AI 將利用此容量為開源模型提供推論服務。IBM 表示,這是 IBM Cloud 上首個以此規模建構、圍繞 B300 打造的專用推論叢集,並配置了 Nvidia 的 Spectrum-X 乙太網路。
Nvidia 宣稱該配置可產生比前一代多 30 倍的「AI 工廠產出」,不過此數據尚未經過獨立驗證。
Together AI 每月 400 兆個 token 將在 IBM 上運行
Together AI 近期以 83 億美元的估值完成了 8 億美元的 C 輪融資,旨在擴展其稱之為 AI Native Cloud 的平台。該公司成立於 2022 年,向希望基於開放、模組化 AI 技術堆疊而非封閉專有模型進行建構的企業出租雲端基礎設施。這一定位使 Together AI 處於一個競爭激烈的市場中,競爭對手包括 OpenAI 和 Anthropic 等專有 API 供應商,以及其他專注於開源推論的平台,企業需要在成本、控制權和效能之間權衡取捨。
根據 IBM 的新聞稿,Together AI 目前每月透過其推論產品處理 400 兆個 token,並支援超過 100 萬名開發者。IBM 叢集將為 Together AI 的擴展計畫提供基礎設施平台。
Together AI 執行長 Vipul Ved Prakash 表示,該協議使公司能夠觸及更多客戶,而無需要求他們支付前沿模型的高昂價格。
「企業希望獲得最佳前沿模型的效能,但不願承受封閉模型的昂貴代價,而這只有在底層基礎設施具備大規模的快速與可靠性的情況下才能實現,」Prakash 在新聞稿中表示。他補充道,該叢集代表了「我們推動開源 AI 成為企業首選的重要一步。」
IBM 深化與 Nvidia 夥伴關係以服務 AI 新創公司
對 IBM 而言,與 Together AI 的協議為其與 Nvidia 日益深化的夥伴關係再添一筆。IBM Cloud 總經理 Alan Peacock 表示,該部署回應了企業對代理式 AI 的需求,並指出 IBM 和 Nvidia 正在「提供可擴展、經濟實惠且企業級的 AI 基礎設施」,以加速 Together AI 的營運。該協議凸顯了 IBM Cloud 透過提供與特定高成長 AI 客戶綁定的專用 GPU 容量,與大型超規模雲端供應商競爭 AI 基礎設施工作負載的策略。
Nvidia HPC 與 AI 基礎設施高級總監 Dion Harris 將 AI 工廠描述為正變得如電力或電信般不可或缺的基礎設施。
IBM 還指出,兩家公司一直在 GPU 原生資料分析和非結構化資料萃取方面進行合作。該夥伴關係涵蓋顧問服務,Together AI 叢集被定位為向大型企業和新創公司銷售 AI 容量的更廣泛策略的一部分。