Акции AMD восстановились после объявления о партнерстве в области AI-инференса с Cerebras Systems
Ключевые выводы
- •AMD и Cerebras разработали платформу AI-инференса, объединяющую стоечные системы AMD Helios с Cerebras Wafer-Scale Engine.
- •Платформа разделяет обработку промптов и генерацию токенов, назначая каждый этап специализированному оборудованию.
- •Компании ожидают, что архитектура обеспечит до пяти раз больше токенов в секунду на ватт, чем существующие решения.
- •Cerebras планирует развернуть системы AMD Helios в своих дата-центрах и представить предложение через Cerebras Cloud во второй половине 2026 года.
- •Акции AMD выросли на 1.54% на постмаркетных торгах после снижения на 2.29% в ходе основной сессии.

Акции Advanced Micro Devices (AMD) восстановились на постмаркетных торгах после объявления о техническом партнерстве с Cerebras Systems, направленном на создание высокопроизводительной платформы AI-инференса.
Акции AMD закрылись на уровне $539.69, снизившись на 2.29% в ходе основной сессии, а затем выросли на 1.54% на постмаркетных торгах до $548.00. Восстановление произошло после того, как компания представила сотрудничество с Cerebras на мероприятии Advancing AI 2026.
AMD и Cerebras представили дезагрегированную платформу AI-инференса
AMD и Cerebras Systems совместно разработали новое решение для AI-инференса, которое объединяет стоечные системы AMD Helios с Cerebras Wafer-Scale Engine. Платформа предназначена для повышения скорости инференса, энергоэффективности и возможностей масштабного развертывания в ресурсоемких корпоративных нагрузках.
В основе партнерства лежит дезагрегированная архитектура, которая разделяет обработку промптов и генерацию токенов в рамках единого рабочего процесса инференса. AMD Helios отвечает за высокопроизводительное выполнение промптов и управление большими контекстными окнами, тогда как Cerebras Wafer-Scale Engine ускоряет генерацию токенов со сверхнизкой задержкой.
Компании ожидают, что объединенная архитектура обеспечит до пяти раз больше токенов в секунду на ватт по сравнению с существующими решениями. Этот прирост эффективности призван одновременно решить задачи производительности и энергопотребления современных AI-приложений, где потребление энергии и охлаждение стали ключевыми ограничениями для операторов дата-центров, масштабирующих AI-инфраструктуру.
Ориентация на AI-приложения реального времени
Дизайн отражает формирующуюся реальность в AI-инференсе: разные вычислительные задачи требуют разной инфраструктуры. Если одни развертывания ориентированы на максимальную пропускную способность для больших объемов запросов, то другие — такие как инструменты для программирования, автономные агенты и помощники в реальном времени — требуют значительно более быстрого времени отклика.
В новой платформе каждый этап рабочей нагрузки назначается специализированному оборудованию. AMD Helios обрабатывает промпты с пропускной способностью стоечного масштаба, а Cerebras Wafer-Scale Engine выполняет ресурсоемкую по памяти генерацию токенов с уменьшенной задержкой. По данным компаний, более быстрая генерация токенов улучшает качество ответов в интерактивных нагрузках, что делает архитектуру подходящей для разработки программного обеспечения, робототехники, научных исследований и автономных систем.
Этот подход позиционирует AMD вместе с Cerebras как претендентов на роль альтернативы доминирующей GPU-центричной парадигме инференса, используя взаимодополняющие архитектуры, а не конкурируя исключительно по производительности универсальных ускорителей.
Развертывание через Cerebras Cloud
Cerebras планирует развернуть системы AMD Helios в своей инфраструктуре дата-центров. Ожидается, что совместное предложение будет представлено через Cerebras Cloud во второй половине 2026 года, расширяя коммерческий охват новейших продуктов AMD для AI-инфраструктуры.
Объявление укрепляет стратегию AMD по расширению за пределы обучения AI в рынок вычислений для инференса. По мере того как организации развертывают более крупные производственные AI-системы, спрос на инфраструктуру, оптимизированную для инференса, продолжает расти, подталкивая поставщиков оборудования к специализированным платформам вместо универсальной обработки. Широко ожидается, что сегмент инференса будет составлять большую долю расходов на AI-вычисления по мере перехода генеративных AI-приложений из разработки в промышленное развертывание.
Партнерство также подчеркивает более широкий отраслевой сдвиг в сторону гетерогенных вычислительных архитектур, в которых компании объединяют специализированные процессоры для повышения эффективности в различных AI-нагрузках. Восстановление акций AMD на постмаркете последовало за реакцией рынка на расширенную стратегию компании в области AI-инфраструктуры.