NachrichtenAktienIBM und Together AI unterzeichnen Mehrjahresabkommen über 240 Millionen Dollar für Nvidia-basierten Inferenz-Cluster auf IBM Cloud

IBM und Together AI unterzeichnen Mehrjahresabkommen über 240 Millionen Dollar für Nvidia-basierten Inferenz-Cluster auf IBM Cloud

Autor: Cryptopolitan·

Wichtige Erkenntnisse

  • IBM hat sich über mehrere Jahre zu 240 Millionen Dollar verpflichtet, um Together AI einen dedizierten Nvidia HGX B300-Inferenz-Cluster auf IBM Cloud bereitzustellen.
  • Die B300-Systeme, die mit Nvidia Spectrum-X-Ethernet-Netzwerktechnologie konfiguriert sind, sollen im ersten Quartal 2027 den Betrieb aufnehmen.
  • Together AI verarbeitet derzeit 400 Billionen Tokens pro Monat über sein Inferenzprodukt und unterstützt mehr als eine Million Entwickler.
  • Together AI hat kürzlich eine Series-C-Finanzierungsrunde über 800 Millionen Dollar bei einer Bewertung von 8,3 Milliarden Dollar abgeschlossen, um seine AI Native Cloud-Plattform zu erweitern.
  • Das Abkommen spiegelt die Strategie von IBM Cloud wider, durch den Einsatz dedizierter GPU-Kapazitäten für stark wachsende KI-Kunden mit größeren Hyperscale-Anbietern zu konkurrieren.
IBM und Together AI unterzeichnen Mehrjahresabkommen über 240 Millionen Dollar für Nvidia-basierten Inferenz-Cluster auf IBM Cloud

IBM hat sich zu einem Mehrjahresabkommen über 240 Millionen Dollar mit Together AI verpflichtet, um einen dedizierten Nvidia-Inferenz-Cluster auf der IBM Cloud zu errichten, wie die beiden Unternehmen am Dienstag mitteilten. Der Vertrag verschafft dem Open-Source-KI-Anbieter einen beträchtlichen Block an GPU-Kapazität auf Unternehmensebene, während er sein Engagement bei großen Unternehmenskonten ausbaut. Das Abkommen spiegelt auch einen breiteren Wandel bei den Ausgaben für KI-Infrastruktur wider, da die Nachfrage nach Inferenz – dem Prozess der Ausführung trainierter Modelle zur Generierung von Ausgaben – parallel zum Einsatz von KI-Anwendungen in Produktionsumgebungen wächst.

HGX B300-Systeme sollen Anfang 2027 online gehen

Gemäß dem unterzeichneten Abkommen wird IBM einen großen Cluster aus Nvidia HGX B300-Systemen innerhalb der IBM Cloud einrichten. Die Hardware soll laut IBM-Pressemitteilung im ersten Quartal 2027 in Betrieb gehen. Die mehrjährige Vorlaufzeit unterstreicht die heute üblichen, längeren Planungshorizonte für die Sicherung von GPU-Kapazitäten der nächsten Generation, da Cloud-Anbieter und KI-Unternehmen Hardware lange vor dem Versand binden.

Together AI wird diese Kapazität nutzen, um Inferenz für Open-Source-Modelle bereitzustellen. IBM erklärte, dass dies der erste dedizierte Cluster dieser Größenordnung für Inferenz auf IBM Cloud rund um das B300-System sei, das mit Nvidias Spectrum-X-Ethernet-Netzwerktechnologie konfiguriert ist.

Nvidia behauptete, dass die Konfiguration das 30-fache an „KI-Fabrik-Output“ im Vergleich zur vorherigen Generation erzeugen könne, obwohl diese Zahl nicht unabhängig verifiziert wurde.

Together AIs 400 Billionen monatliche Tokens sollen auf IBM laufen

Together AI hat kürzlich eine Series-C-Finanzierungsrunde in Höhe von 800 Millionen Dollar bei einer Bewertung von 8,3 Milliarden Dollar abgeschlossen, um das auszubauen, was das Unternehmen als „AI Native Cloud“ bezeichnet. Das 2022 gegründete Unternehmen vermietet Cloud-Infrastruktur an Unternehmen, die auf offenen, modularen KI-Stacks aufbauen möchten, anstatt auf geschlossenen proprietären Modellen. Diese Positionierung bringt Together AI in ein wettbewerbsintensives Umfeld, das sowohl proprietäre API-Anbieter wie OpenAI und Anthropic als auch andere auf Open-Source fokussierte Inferenzplattformen umfasst, während Unternehmen Kosten, Kontrolle und Leistung abwägen.

Laut der Pressemitteilung von IBM leitet Together AI derzeit monatlich 400 Billionen Tokens über sein Inferenzprodukt und unterstützt mehr als eine Million Entwickler. Der IBM-Cluster wird die Infrastrukturplattform für die geplante Expansion von Together AI bilden.

Together AI CEO Vipul Ved Prakash sagte, das Abkommen ermögliche es dem Unternehmen, mehr Kunden zu erreichen, ohne sie zu zwingen, Preise für Frontier-Modelle zu zahlen.

„Unternehmen wollen die Leistung der besten Frontier-Modelle ohne das Preisschild geschlossener Modelle, und das funktioniert nur, wenn die darunterliegende Infrastruktur schnell und im großen Maßstab zuverlässig ist“, sagte Prakash in der Mitteilung. Er fügte hinzu, dass der Cluster „ein großer Schritt in unserem Bestreben ist, Open-Source-KI zur naheliegenden Wahl für Unternehmen zu machen“.

IBM vertieft Nvidia-Partnerschaft zur Betreuung von KI-Startups

Für IBM fügt das Abkommen mit Together AI eine weitere Ebene zu seiner wachsenden Partnerschaft mit Nvidia hinzu. Alan Peacock, General Manager von IBM Cloud, sagte, die Bereitstellung reagiere auf die Nachfrage von Unternehmen nach agentenbasierter KI, und stellte fest, dass IBM und Nvidia „skalierbare, wirtschaftliche, unternehmensgerechte KI-Infrastruktur“ liefern, um die Abläufe von Together AI zu beschleunigen. Der Deal signalisiert die Bemühungen von IBM Cloud, durch die Bereitstellung dedizierter, an spezifische, stark wachsende KI-Kunden gebundener GPU-Kapazitäten mit größeren Hyperscale-Cloud-Anbietern um Arbeitslasten für KI-Infrastruktur zu konkurrieren.

Dion Harris, Senior Director für HPC- und KI-Infrastruktur bei Nvidia, beschrieb KI-Fabriken als Infrastruktur, die genauso grundlegend werde wie Strom oder Telekommunikation.

IBM wies auch darauf hin, dass die beiden Unternehmen zusätzlich zur Extraktion unstrukturierter Daten an GPU-nativer Datenanalyse zusammengearbeitet haben. Die Partnerschaft umfasst Beratungsdienstleistungen, wobei der Together AI-Cluster als Teil einer breiteren Strategie positioniert wird, KI-Kapazitäten sowohl an große Unternehmen als auch an Startups zu verkaufen.