Las acciones de AMD se recuperan tras anunciar una asociación de inferencia de IA con Cerebras Systems
Puntos clave
- •AMD y Cerebras desarrollaron una plataforma de inferencia de IA que combina los sistemas rackscale AMD Helios con el Cerebras Wafer-Scale Engine.
- •La plataforma separa el procesamiento de prompts de la generación de tokens, asignando cada etapa a hardware especializado.
- •Las empresas esperan que la arquitectura ofrezca hasta cinco veces más tokens por segundo por vatio que las soluciones existentes.
- •Cerebras planea desplegar sistemas AMD Helios en sus centros de datos e introducir la oferta a través de Cerebras Cloud en el segundo semestre de 2026.
- •Las acciones de AMD subieron un 1,54 % en operaciones extrabursátiles tras caer un 2,29 % durante la sesión regular.

Las acciones de Advanced Micro Devices (AMD) se recuperaron en las operaciones extrabursátiles tras el anuncio de una asociación técnica con Cerebras Systems destinada a ofrecer una plataforma de inferencia de IA de alto rendimiento.
Las acciones de AMD cerraron en $539.69, con una caída del 2,29 % durante la sesión regular, antes de subir un 1,54 % en la actividad extrabursátil hasta $548.00. La recuperación se produjo cuando la empresa presentó su colaboración con Cerebras durante el evento Advancing AI 2026.
AMD y Cerebras presentan una plataforma de inferencia de IA desagregada
AMD y Cerebras Systems han desarrollado conjuntamente una nueva solución de inferencia de IA que integra los sistemas rackscale AMD Helios con el Cerebras Wafer-Scale Engine. La plataforma está diseñada para mejorar la velocidad de inferencia, la eficiencia energética y las capacidades de despliegue a gran escala en cargas de trabajo empresariales exigentes.
En el centro de la asociación se encuentra una arquitectura desagregada que separa el procesamiento de prompts de la generación de tokens dentro de un único flujo de trabajo de inferencia. AMD Helios es responsable de la ejecución de prompts de alto rendimiento y de la gestión de grandes ventanas de contexto, mientras que el Cerebras Wafer-Scale Engine acelera la generación de tokens con latencia ultrabaja.
Las empresas esperan que la arquitectura combinada ofrezca hasta cinco veces más tokens por segundo por vatio en comparación con las soluciones existentes. Esta mejora de eficiencia está destinada a satisfacer las demandas simultáneas de rendimiento y energía de las aplicaciones de IA modernas, donde el consumo energético y la refrigeración se han convertido en restricciones determinantes para los operadores de centros de datos que escalan su infraestructura de IA.
Dirigido a aplicaciones de IA en tiempo real
El diseño refleja una realidad emergente en la inferencia de IA: diferentes tareas de cómputo exigen diferentes infraestructuras. Mientras que algunos despliegues priorizan el rendimiento máximo para grandes volúmenes de solicitudes, otros —como herramientas de programación, agentes autónomos y asistentes en vivo— requieren tiempos de respuesta significativamente más rápidos.
Bajo la nueva plataforma, cada etapa de carga de trabajo se asigna a hardware especializado. AMD Helios procesa los prompts con rendimiento a escala de rack, y el Cerebras Wafer-Scale Engine maneja la generación de tokens intensiva en memoria con latencia reducida. Según las empresas, una generación de tokens más rápida mejora la calidad de respuesta durante las cargas de trabajo interactivas, lo que hace que la arquitectura sea adecuada para el desarrollo de software, la robótica, la investigación científica y los sistemas autónomos.
El enfoque posiciona a AMD junto a Cerebras como desafiantes del paradigma de inferencia dominante centrado en GPU, aprovechando arquitecturas complementarias en lugar de competir únicamente en el rendimiento de aceleradores de propósito general.
Despliegue a través de Cerebras Cloud
Cerebras planea desplegar los sistemas AMD Helios en su infraestructura de centros de datos. Se espera que la oferta conjunta se introduzca a través de Cerebras Cloud durante el segundo semestre de 2026, ampliando el alcance comercial de los últimos productos de infraestructura de IA de AMD.
El anuncio refuerza la estrategia de AMD de expandirse más allá del entrenamiento de IA hacia el mercado de la computación de inferencia. A medida que las organizaciones despliegan sistemas de IA de producción más grandes, la demanda de infraestructura optimizada para inferencia sigue creciendo, empujando a los proveedores de hardware hacia plataformas especializadas en lugar del procesamiento de propósito general. Se espera ampliamente que el segmento de inferencia represente la mayor proporción del gasto en cómputo de IA a medida que las aplicaciones de IA generativa pasen del desarrollo al despliegue en producción.
La asociación también destaca un cambio más amplio de la industria hacia arquitecturas de cómputo heterogéneas, donde las empresas combinan procesadores especializados para mejorar la eficiencia en diferentes cargas de trabajo de IA. La recuperación de las acciones de AMD en horario extrabursátil siguió a la reacción del mercado ante la estrategia de infraestructura de IA ampliada de la empresa.