IBM en Together AI tekenen meerjarige overeenkomst van $240 miljoen voor Nvidia-aangedreven inference-cluster op IBM Cloud
Belangrijkste punten
- •IBM heeft $240 miljoen over meerdere jaren toegezegd om Together AI te voorzien van een specifiek Nvidia HGX B300 inference-cluster dat op IBM Cloud wordt gehost.
- •De B300-systemen, geconfigureerd met Nvidia Spectrum-X Ethernet-netwerk, staan gepland om in het eerste kwartaal van 2027 in bedrijf te worden gesteld.
- •Together AI verwerkt momenteel 400 biljoen tokens per maand via zijn inference-product en ondersteunt meer dan een miljoen ontwikkelaars.
- •Together AI heeft onlangs een Series C-financieringsronde van $800 miljoen afgerond tegen een waardering van $8,3 miljard om zijn AI Native Cloud-platform uit te breiden.
- •De overeenkomst weerspiegelt de strategie van IBM Cloud om te concurreren met grotere hyperscale-providers door specifieke GPU-capaciteit aan te bieden die is gekoppeld aan snelgroeiende AI-klanten.

IBM heeft een meerjarige overeenkomst van $240 miljoen gesloten met Together AI om een specifiek Nvidia inference-cluster te bouwen op IBM Cloud, zo maakten de twee bedrijven op dinsdag bekend. De overeenkomst biedt de opensource AI-provider een aanzienlijke hoeveelheid enterprise-grade GPU-capaciteit terwijl het bedrijf zijn bereik naar grote zakelijke klanten uitbreidt. De overeenkomst weerspiegelt ook een bredere verschuiving in AI-infrastructuuruitgaven, aangezien de vraag naar inference — het proces waarbij getrainde modellen worden gebruikt om output te genereren — toeneemt parallel aan de uitrol van AI-toepassingen in productieomgevingen.
HGX B300-systemen komen in begin 2027 online
Onder de getekende overeenkomst zal IBM een groot cluster van Nvidia HGX B300-systemen binnen IBM Cloud uitrollen. De hardware zal naar verwachting in het eerste kwartaal van 2027 online komen, volgens IBM's newsroom-persbericht. De doorlooptijd van meerdere jaren onderstreept de langere planningshorizonten die inmiddels gebruikelijk zijn voor het veiligstellen van GPU-capaciteit van de volgende generatie, nu cloudproviders en AI-bedrijven hardware vastleggen lang voordat deze wordt geleverd.
Together AI zal deze capaciteit gebruiken om inference te leveren op opensource modellen. IBM stelde dat dit het eerste specifieke cluster van deze schaal is dat voor inference op IBM Cloud rond de B300 is gebouwd, geconfigureerd met Nvidia's Spectrum-X Ethernet-netwerk.
Nvidia beweerde dat de configuratie 30 keer meer "AI factory-output" kan genereren dan de vorige generatie, hoewel dit cijfer niet onafhankelijk is geverifieerd.
Together AI's 400 biljoen maandelijkse tokens draaien op IBM
Together AI heeft onlangs een Series C-financieringsronde van $800 miljoen afgerond tegen een waardering van $8,3 miljard, gericht op de uitbreiding van wat het zijn AI Native Cloud noemt. Het in 2022 opgerichte bedrijf verhuurt cloudinfrastructuur aan ondernemingen die willen bouwen op open, modulaire AI-stacks in plaats van op gesloten propriëtaire modellen. Die positionering plaatst Together AI in een competitief landschap dat zowel propriëtaire API-providers zoals OpenAI en Anthropic als andere op opensource gerichte inference-platforms omvat, terwijl ondernemingen afwegingen maken tussen kosten, controle en prestaties.
Volgens het persbericht van IBM verwerkt Together AI momenteel 400 biljoen tokens per maand via zijn inference-product en ondersteunt het meer dan een miljoen ontwikkelaars. Het IBM-cluster zal het infrastructuurplatform vormen voor de geplande uitbreiding van Together AI.
Together AI-CEO Vipul Ved Prakash zei dat de overeenkomst het bedrijf in staat stelt meer klanten te bereiken zonder hen te verplichten prijzen van grensmodellen te betalen.
"Ondernemingen willen de prestaties van de beste grensmodellen zonder het prijskaartje van gesloten modellen, en dat werkt alleen als de onderliggende infrastructuur snel en betrouwbaar is op schaal," aldus Prakash in het persbericht. Hij voegde toe dat het cluster "een grote stap is in onze inspanningen om opensource AI de voor de hand liggende keuze voor ondernemingen te maken."
IBM verdiept Nvidia-partnerschap om AI-startups te bedienen
Voor IBM voegt de overeenkomst met Together AI een nieuwe laag toe aan zijn groeiende partnerschap met Nvidia. Alan Peacock, algemeen directeur van IBM Cloud, zei dat de uitrol inspeelt op de zakelijke vraag naar agentic AI, en merkte op dat IBM en Nvidia "schaalbare, economische, enterprise-grade AI-infrastructuur leveren" om de operaties van Together AI te versnellen. De overeenkomst is een signaal van de inspanningen van IBM Cloud om te concurreren voor AI-infrastructuurworkloads tegen grotere hyperscale-cloudproviders door specifieke GPU-capaciteit aan te bieden die is gekoppeld aan snelgroeiende AI-klanten.
Dion Harris, een senior director voor HPC- en AI-infrastructuur bij Nvidia, beschreef AI-fabrieken als infrastructuur die net zo fundamenteel wordt als elektriciteit of telecommunicatie.
IBM merkte ook op dat de twee bedrijven samenwerken aan GPU-native data-analyse en extractie van ongestructureerde data. Het partnerschap omvat ook adviesdiensten, waarbij het Together AI-cluster is gepositioneerd als onderdeel van een bredere strategie om AI-capaciteit te verkopen aan zowel grote ondernemingen als startups.