IBM et Together AI signent un accord pluriannuel de 240 millions de dollars pour un cluster d'inférence propulsé par Nvidia sur IBM Cloud
Points clés
- •IBM s'est engagé à hauteur de 240 millions de dollars sur plusieurs années pour fournir à Together AI un cluster d'inférence Nvidia HGX B300 dédié hébergé sur IBM Cloud.
- •Les systèmes B300, configurés avec le réseau Ethernet Spectrum-X de Nvidia, doivent commencer leurs opérations au premier trimestre 2027.
- •Together AI traite actuellement 400 000 milliards de jetons par mois grâce à son produit d'inférence et prend en charge plus d'un million de développeurs.
- •Together AI a récemment bouclé un tour de financement de série C de 800 millions de dollars à une valorisation de 8,3 milliards de dollars pour développer sa plateforme AI Native Cloud.
- •L'accord reflète la stratégie d'IBM Cloud pour rivaliser avec les plus grands fournisseurs hyperscale en proposant une capacité GPU dédiée liée à des clients IA à forte croissance spécifiques.

IBM s'est engagé dans un accord pluriannuel de 240 millions de dollars avec Together AI pour construire un cluster d'inférence Nvidia dédié sur IBM Cloud, ont annoncé les deux entreprises mardi. L'accord fournit au fournisseur d'IA open source un bloc important de capacité GPU de qualité entreprise alors qu'il étend sa portée vers les grands comptes d'entreprise. L'accord reflète également une évolution plus large des dépenses d'infrastructure IA, la demande d'inférence — le processus d'exécution de modèles entraînés pour générer des résultats — augmentant parallèlement au déploiement d'applications d'IA dans des environnements de production.
Les systèmes HGX B300 devraient être en ligne début 2027
Dans le cadre de l'accord signé, IBM déploiera un grand cluster de systèmes Nvidia HGX B300 au sein d'IBM Cloud. Le matériel devrait être en ligne au premier trimestre 2027, selon le communiqué de presse d'IBM. Le délai pluriannuel souligne les horizons de planification étendus désormais courants pour sécuriser la capacité GPU de nouvelle génération, alors que les fournisseurs de cloud et les entreprises d'IA verrouillent le matériel bien avant son expédition.
Together AI utilisera cette capacité pour servir l'inférence sur des modèles open source. IBM a déclaré qu'il s'agissait du premier cluster dédié de cette envergure construit pour l'inférence sur IBM Cloud autour du B300, configuré avec le réseau Ethernet Spectrum-X de Nvidia.
Nvidia a affirmé que la configuration peut générer 30 fois plus de « production d'usine IA » que sa génération précédente, bien que ce chiffre n'ait pas été vérifié indépendamment.
Les 400 000 milliards de jetons mensuels de Together AI fonctionneront sur IBM
Together AI a récemment bouclé un tour de financement de série C de 800 millions de dollars avec une valorisation de 8,3 milliards de dollars, visant à développer ce qu'elle appelle son AI Native Cloud. Fondée en 2022, l'entreprise loue une infrastructure cloud aux entreprises cherchant à construire sur des piles IA ouvertes et modulaires plutôt que sur des modèles propriétaires fermés. Ce positionnement place Together AI dans un paysage concurrentiel qui comprend à la fois des fournisseurs d'API propriétaires tels qu'OpenAI et Anthropic, ainsi que d'autres plateformes d'inférence axées sur l'open source, alors que les entreprises pèsent les compromis entre coût, contrôle et performances.
Selon le communiqué de presse d'IBM, Together AI canalise actuellement 400 000 milliards de jetons par mois via son produit d'inférence et prend en charge plus d'un million de développeurs. Le cluster IBM fournira la plateforme d'infrastructure pour l'expansion prévue par Together AI.
Le PDG de Together AI, Vipul Ved Prakash, a déclaré que l'accord permettait à l'entreprise d'atteindre plus de clients sans leur imposer de payer les prix des modèles de pointe.
« Les entreprises veulent les performances des meilleurs modèles de pointe sans le prix des modèles fermés, et cela ne fonctionne que si l'infrastructure sous-jacente est rapide et fiable à grande échelle », a déclaré Prakash dans le communiqué. Il a ajouté que le cluster représente « un grand pas en avant dans notre volonté de faire de l'IA open source le choix évident pour les entreprises ».
IBM renforce son partenariat avec Nvidia pour servir les startups IA
Pour IBM, l'accord avec Together AI ajoute une dimension supplémentaire à son partenariat grandissant avec Nvidia. Alan Peacock, directeur général d'IBM Cloud, a déclaré que le déploiement répondait à la demande des entreprises pour une IA agentique, notant qu'IBM et Nvidia « fournissent une infrastructure IA évolutive, économique et de qualité entreprise » pour accélérer les opérations de Together AI. L'accord illustre les efforts d'IBM Cloud pour concurrencer les plus grands fournisseurs de cloud hyperscale en matière de charges de travail d'infrastructure IA, en proposant une capacité GPU dédiée liée à des clients IA à forte croissance spécifiques.
Dion Harris, directeur principal du HPC et de l'infrastructure IA chez Nvidia, a décrit les usines IA comme une infrastructure devenant aussi fondamentale que l'électricité ou les télécommunications.
IBM a également noté que les deux entreprises collaboraient sur l'analyse de données native GPU et l'extraction de données non structurées. Le partenariat comprend des services de conseil, avec le cluster de Together AI positionné comme faisant partie d'une stratégie plus large visant à vendre de la capacité IA aux grandes entreprises comme aux startups.