NotizieAzioniIBM e Together AI firmano un accordo pluriennale da 240 milioni di dollari per un cluster di inferenza Nvidia su IBM Cloud

IBM e Together AI firmano un accordo pluriennale da 240 milioni di dollari per un cluster di inferenza Nvidia su IBM Cloud

Autore: Cryptopolitan·

Punti chiave

  • IBM si è impegnata per 240 milioni di dollari su più anni per fornire a Together AI un cluster di inferenza Nvidia HGX B300 dedicato ospitato su IBM Cloud.
  • I sistemi B300, configurati con rete Ethernet Nvidia Spectrum-X, sono previsti per iniziare le operazioni nel primo trimestre del 2027.
  • Together AI attualmente elabora 400 trilioni di token al mese attraverso il suo prodotto di inferenza e supporta oltre un milione di sviluppatori.
  • Together AI ha recentemente completato un round di finanziamenti Serie C da 800 milioni di dollari con una valutazione di 8,3 miliardi di dollari per espandere la sua piattaforma AI Native Cloud.
  • L'accordo riflette la strategia di IBM Cloud di competere con i principali provider hyperscale offrendo capacità GPU dedicata legata a specifici clienti AI ad alta crescita.
IBM e Together AI firmano un accordo pluriennale da 240 milioni di dollari per un cluster di inferenza Nvidia su IBM Cloud

IBM si è impegnata in un accordo pluriennale da 240 milioni di dollari con Together AI per costruire un cluster di inferenza Nvidia dedicato su IBM Cloud, come hanno annunciato congiuntamente le due aziende martedì. L'accordo fornisce al provider di AI open-source un blocco sostanziale di capacità GPU di livello enterprise mentre amplia la propria presenza nei grandi conti aziendali. L'accordo riflette inoltre un cambiamento più ampio nella spesa per infrastrutture AI, poiché la domanda di inferenza — il processo di esecuzione di modelli addestrati per generare output — cresce insieme alla distribuzione di applicazioni AI in ambienti di produzione.

I sistemi HGX B300 entreranno in funzione all'inizio del 2027

Secondo l'accordo firmato, IBM distribuirà un grande cluster di sistemi Nvidia HGX B300 all'interno di IBM Cloud. L'hardware è previsto online nel primo trimestre del 2027, secondo il comunicato stampa di IBM. I tempi pluriennali evidenziano gli orizzonti di pianificazione estesi ormai comuni per garantire capacità GPU di prossima generazione, mentre i provider cloud e le aziende AI bloccano l'hardware ben prima della sua spedizione.

Together AI utilizzerà questa capacità per fornire inferenza su modelli open-source. IBM ha dichiarato che questo è il primo cluster dedicato di questa scala costruito per l'inferenza su IBM Cloud basato sui B300, configurato con rete Ethernet Nvidia Spectrum-X.

Nvidia ha affermato che la configurazione può generare 30 volte più "output di fabbrica AI" rispetto alla generazione precedente, sebbene questa cifra non sia stata verificata in modo indipendente.

I 400 trilioni di token mensili di Together AI saranno eseguiti su IBM

Together AI ha recentemente completato un round di finanziamenti Serie C da 800 milioni di dollari con una valutazione di 8,3 miliardi di dollari, volto a espandere ciò che chiama AI Native Cloud. Fondata nel 2022, l'azienda affitta infrastrutture cloud a imprese che desiderano costruire su stack AI aperti e modulari anziché su modelli proprietari chiusi. Questo posizionamento colloca Together AI in un panorama competitivo che include sia provider di API proprietarie come OpenAI e Anthropic, sia altre piattaforme di inferenza focalizzate sull'open-source, mentre le aziende valutano i compromessi tra costo, controllo e prestazioni.

Secondo il comunicato stampa di IBM, Together AI attualmente convoglia 400 trilioni di token al mese attraverso il suo prodotto di inferenza e supporta oltre un milione di sviluppatori. Il cluster IBM fornirà la piattaforma infrastrutturale per l'espansione pianificata di Together AI.

Il CEO di Together AI Vipul Ved Prakash ha dichiarato che l'accordo consente all'azienda di raggiungere più clienti senza richiedere loro di pagare i prezzi dei modelli di frontiera.

"Le aziende vogliono le prestazioni dei migliori modelli di frontiera senza il prezzo dei modelli chiusi, e questo funziona solo se l'infrastruttura sottostante è veloce e affidabile su larga scala", ha dichiarato Prakash nel comunicato. Ha aggiunto che il cluster rappresenta "un grande passo nella nostra spinta per rendere l'AI open-source la scelta ovvia per le imprese".

IBM approfondisce la partnership con Nvidia per servire le startup AI

Per IBM, l'accordo con Together AI aggiunge un altro livello alla sua crescente partnership con Nvidia. Alan Peacock, direttore generale di IBM Cloud, ha spiegato che la distribuzione risponde alla domanda aziendale di AI agentica, noting che IBM e Nvidia stanno "fornendo infrastrutture AI scalabili, economiche e di livello enterprise" per accelerare le operazioni di Together AI. L'accordo segnala lo sforzo di IBM Cloud di competere per i carichi di lavoro di infrastruttura AI contro i principali provider hyperscale cloud, offrendo capacità GPU dedicata legata a specifici clienti AI ad alta crescita.

Dion Harris, senior director per HPC e infrastrutture AI presso Nvidia, ha descritto le fabbriche AI come infrastrutture che stanno diventando fondamentali quanto l'elettricità o le telecomunicazioni.

IBM ha inoltre precisato che le due aziende stanno collaborando all'analisi dei dati nativa GPU e all'estrazione di dati non strutturati. La partnership include servizi di consulenza, con il cluster di Together AI posizionato come parte di una strategia più ampia per vendere capacità AI sia alle grandi imprese che alle startup.