AktualnościAkcjeIBM i Together AI podpisują wieloletnią umowę o wartości 240 milionów dolarów na klaster inferencyjny napędzany technologią Nvidia w IBM Cloud

IBM i Together AI podpisują wieloletnią umowę o wartości 240 milionów dolarów na klaster inferencyjny napędzany technologią Nvidia w IBM Cloud

Autor: Cryptopolitan·

Najważniejsze informacje

  • IBM zobowiązał się do 240 milionów dolarów w ramach wieloletniej umowy, aby zapewnić Together AI dedykowany klaster inferencyjny Nvidia HGX B300 hostowany w IBM Cloud.
  • Systemy B300, skonfigurowane z siecią Ethernet Nvidia Spectrum-X, mają rozpocząć działanie w pierwszym kwartale 2027 roku.
  • Together AI obecnie przetwarza 400 bilionów tokenów miesięcznie przez swój produkt inferencyjny i obsługuje ponad milion deweloperów.
  • Together AI niedawno zakończył rundę finansowania Series C o wartości 800 milionów dolarów przy wycenie 8,3 miliarda dolarów w celu rozbudowy swojej platformy AI Native Cloud.
  • Umowa odzwierciedla strategię IBM Cloud polegającą na konkurowaniu z większymi dostawcami hiperskaliowymi poprzez oferowanie dedykowanej zdolności GPU powiązanej z konkretnymi klientami AI o wysokim wzroście.
IBM i Together AI podpisują wieloletnią umowę o wartości 240 milionów dolarów na klaster inferencyjny napędzany technologią Nvidia w IBM Cloud

IBM zobowiązał się do wieloletniej umowy o wartości 240 milionów dolarów z Together AI w celu zbudowania dedykowanego klastra inferencyjnego Nvidia w IBM Cloud, jak ogłosiły obie firmy we wtorek. Umowa zapewnia dostawcy AI open-source znaczny pakiet zdolności GPU klasy korporacyjnej w miarę poszerzania jego obecności w dużych klientach korporacyjnych. Porozumienie odzwierciedla również szerszą zmianę w wydatkach na infrastrukturę AI, ponieważ popyt na inferencję — proces uruchamiania wytrenowanych modeli w celu generowania wyników — rośnie wraz z wdrażaniem aplikacji AI w środowiskach produkcyjnych.

Systemy HGX B300 zostaną uruchomione na początku 2027 roku

Zgodnie z podpisaną umową IBM wdroży duży klaster systemów Nvidia HGX B300 w ramach IBM Cloud. Sprzęt ma zostać uruchomiony w pierwszym kwartale 2027 roku, zgodnie z komunikatem prasowym IBM. Wieloletni czas realizacji podkreśla wydłużone horyzonty planowania, obecnie powszechne przy pozyskiwaniu zdolności GPU nowej generacji, ponieważ dostawcy chmury i firmy AI rezerwują sprzęt na długo przed jego wysyłką.

Together AI wykorzysta tę zdolność do świadczenia inferencji na modelach open-source. IBM oświadczył, że jest to pierwszy dedykowany klaster tej skali zbudowany dla inferencji w IBM Cloud oparty na B300, skonfigurowany z siecią Ethernet Nvidia Spectrum-X.

Nvidia oświadczyła, że konfiguracja może generować 30 razy więcej „produkcji fabrycznej AI” niż jej poprzednia generacja, choć ta wartość nie została niezależnie zweryfikowana.

400 bilionów miesięcznych tokenów Together AI ma działać w IBM

Together AI niedawno zakończył rundę finansowania Series C o wartości 800 milionów dolarów przy wycenie 8,3 miliarda dolarów, mającą na celu rozbudowę tego, co firma nazywa swoim AI Native Cloud. Założona w 2022 roku firma wynajmuje infrastrukturę chmurową przedsiębiorstwom, które chcą budować na otwartych, modułowych stosach AI zamiast na zamkniętych modelach własnościowych. Ta pozycja umieszcza Together AI w konkurencyjnym krajobrazie, który obejmuje zarówno dostawców własnościowych API, takich jak OpenAI i Anthropic, jak i inne platformy inferencyjne skoncentrowane na open-source, podczas gdy przedsiębiorstwa rozważają kompromisy między kosztem, kontrolą a wydajnością.

Według komunikatu prasowego IBM, Together AI obecnie przetwarza 400 bilionów tokenów miesięcznie przez swój produkt inferencyjny i obsługuje ponad milion deweloperów. Klaster IBM zapewni platformę infrastrukturalną dla planowanej ekspansji Together AI.

CEO Together AI Vipul Ved Prakash oświadczył, że umowa umożliwia firmie dotarcie do większej liczby klientów bez zmuszania ich do płacenia cen modeli frontier.

„Przedsiębiorstwa chcą wydajności najlepszych modeli frontier bez ceny modelu zamkniętego, a to działa tylko wtedy, gdy infrastruktura pod spodem jest szybka i niezawodna na dużą skalę” — powiedział Prakash w komunikacie. Dodał, że klaster stanowi „duży krok w naszym dążeniu do uczynienia AI open-source oczywistym wyborem dla przedsiębiorstw”.

IBM pogłębia partnerstwo z Nvidia, aby obsługiwać startupy AI

Dla IBM umowa z Together AI dodaje kolejny wymiar do rosnącego partnerstwa z Nvidia. Alan Peacock, dyrektor generalny IBM Cloud, oświadczył, że wdrożenie stanowi odpowiedź na popyt korporacyjny na agentowe AI, zauważając, że IBM i Nvidia „dostarczają skalowalną, ekonomiczną, korporacyjnej klasy infrastrukturę AI”, aby przyspieszyć operacje Together AI. Umowa sygnalizuje wysiłki IBM Cloud w konkurowaniu o obciążenia infrastrukturalne AI z większymi dostawcami chmury hiperskaliowej poprzez oferowanie dedykowanej zdolności GPU powiązanej z konkretnymi klientami AI o wysokim wzroście.

Dion Harris, starszy dyrektor ds. HPC i infrastruktury AI w Nvidia, opisał fabryki AI jako infrastrukturę stającą się tak fundamentalną jak energia elektryczna czy telekomunikacja.

IBM zaznaczył również, że obie firmy współpracują nad analizą danych natywną dla GPU oraz ekstrakcją danych nieustrukturyzowanych. Partnerstwo obejmuje usługi doradcze, a klaster Together AI jest pozycjonowany jako część szerszej strategii sprzedaży zdolności AI zarówno dużym przedsiębiorstwom, jak i startupom.