НовостиАкцииIBM и Together AI подписали соглашение на 240 миллионов долларов на многолетний Inference-кластер на базе Nvidia в IBM Cloud

IBM и Together AI подписали соглашение на 240 миллионов долларов на многолетний Inference-кластер на базе Nvidia в IBM Cloud

Автор: Cryptopolitan·

Ключевые выводы

  • IBM взяла на себя обязательства на 240 миллионов долларов в течение нескольких лет для предоставления Together AI выделенного inference-кластера Nvidia HGX B300, размещённого в IBM Cloud.
  • Системы B300, сконфигурированные с сетью Nvidia Spectrum-X Ethernet, запланированы к началу эксплуатации в первом квартале 2027 года.
  • Together AI в настоящее время обрабатывает 400 триллионов токенов в месяц через свой inference-продукт и поддерживает более одного миллиона разработчиков.
  • Together AI недавно завершила раунд финансирования серии C на 800 миллионов долларов при оценке в 8,3 миллиарда долларов для расширения своей платформы AI Native Cloud.
  • Соглашение отражает стратегию IBM Cloud по конкуренции с более крупными гипермасштабируемыми провайдерами за счёт предложения выделенных GPU-мощностей, привязанных к конкретным быстрорастущим AI-клиентам.
IBM и Together AI подписали соглашение на 240 миллионов долларов на многолетний Inference-кластер на базе Nvidia в IBM Cloud

IBM заключила многолетнее соглашение на 240 миллионов долларов с Together AI для создания выделенного inference-кластера на базе Nvidia в IBM Cloud, как сообщили обе компании во вторник. Сделка предоставляет поставщику open-source AI-решений значительный блок корпоративных GPU-мощностей по мере его расширения в сегменте крупных корпоративных клиентов. Соглашение также отражает более широкий сдвиг в расходах на AI-инфраструктуру: спрос на inference — процесс запуска обученных моделей для генерации результатов — растёт параллельно с развёртыванием AI-приложений в производственных средах.

Системы HGX B300 начнут работу в начале 2027 года

Согласно подписанному соглашению, IBM развернёт большой кластер систем Nvidia HGX B300 в IBM Cloud. Оборудование, как ожидается, будет запущено в первом квартале 2027 года, сообщается в пресс-релизе IBM. Многолетний срок ввода в эксплуатацию подчёркивает расширенные горизонты планирования, ставшие типичными при обеспечении GPU-мощностями следующего поколения, поскольку облачные провайдеры и AI-компании фиксируют доступ к оборудованию задолго до его выпуска.

Together AI будет использовать эти мощности для обслуживания inference на open-source моделях. IBM заявила, что это первый выделенный кластер подобного масштаба для inference в IBM Cloud на базе B300, сконфигурированный с сетью Nvidia Spectrum-X Ethernet.

Nvidia утверждает, что данная конфигурация может производить в 30 раз больше «AI factory output» по сравнению с предыдущим поколением, однако эта цифра не прошла независимую проверку.

400 триллионов ежемесячных токенов Together AI будут обрабатываться на базе IBM

Together AI недавно завершила раунд финансирования серии C на 800 миллионов долларов при оценке в 8,3 миллиарда долларов, направленный на расширение того, что компания называет своим AI Native Cloud. Основанная в 2022 году, компания предоставляет облачную инфраструктуру предприятиям, стремящимся строить решения на открытых модульных AI-стеках, а не на закрытых проприетарных моделях. Это позиционирование помещает Together AI в конкурентную среду, включающую как проприетарных API-провайдеров, таких как OpenAI и Anthropic, так и другие open-source-ориентированные inference-платформы, поскольку предприятия оценивают компромиссы между стоимостью, контролем и производительностью.

Согласно пресс-релизу IBM, Together AI в настоящее время пропускает 400 триллионов токенов в месяц через свой inference-продукт и поддерживает более одного миллиона разработчиков. Кластер IBM предоставит инфраструктурную платформу для запланированного расширения Together AI.

Генеральный директор Together AI Випул Вед Пракаш (Vipul Ved Prakash) заявил, что соглашение позволяет компании охватить больше клиентов, не требуя от них платить по тарифам frontier-моделей.

«Предприятия хотят производительности лучших frontier-моделей без ценника закрытых моделей, и это работает только при условии, что нижележащая инфраструктура работает быстро и надёжно в масштабе», — сказал Пракаш в пресс-релизе. Он добавил, что кластер представляет «большой шаг в нашем стремлении сделать open-source AI очевидным выбором для предприятий».

IBM укрепляет партнёрство с Nvidia для обслуживания AI-стартапов

Для IBM соглашение с Together AI добавляет ещё один уровень в её растущее партнёрство с Nvidia. Алан Пикок (Alan Peacock), генеральный директор IBM Cloud, заявил, что развёртывание является ответом на корпоративный спрос на агентный AI, отметив, что IBM и Nvidia «предоставляют масштабируемую, экономичную, корпоративную AI-инфраструктуру» для ускорения работы Together AI. Сделка отражает стремление IBM Cloud конкурировать за AI-инфраструктурные рабочие нагрузки с более крупными гипермасштабируемыми облачными провайдерами, предлагая выделенные GPU-мощности, привязанные к конкретным быстрорастущим AI-клиентам.

Дион Харрис (Dion Harris), старший директор по HPC и AI-инфраструктуре в Nvidia, описал AI-фабрики как инфраструктуру, становящуюся такой же фундаментальной, как электричество или телекоммуникации.

IBM также отметила, что две компании сотрудничают в области GPU-native аналитики данных и извлечения неструктурированных данных. Партнёрство включает консультационные услуги, при этом кластер Together AI позиционируется как часть более широкой стратегии по продаже AI-мощностей как крупным предприятиям, так и стартапам.