NoticiasAccionesAMD lanza el rack de servidores de IA Helios en un desafío directo al dominio de Nvidia en centros de datos

AMD lanza el rack de servidores de IA Helios en un desafío directo al dominio de Nvidia en centros de datos

Autor: Cryptopolitan·

Puntos clave

  • Helios es el primer rack de servidores completamente integrado de AMD diseñado para competir con los sistemas insignia de centros de datos de IA de Nvidia.
  • El sistema incluye 72 GPUs Instinct MI455X y CPUs de servidor Epyc, con un rack completamente configurado que ofrece hasta 2.9 exaflops de cómputo FP4 máximo.
  • AMD dijo que Helios proporciona 15% más rendimiento de cómputo, 50% más memoria HBM y 30% más tokens por dólar que Vera Rubin de Nvidia.
  • AMD anunció una alianza con Cerebras para sumar chips enfocados en inferencia a su portafolio de centros de datos.
  • Las acciones de AMD cayeron más de 2% durante la presentación de Su, aunque el título ha subido 222% en los últimos 12 meses.
AMD lanza el rack de servidores de IA Helios en un desafío directo al dominio de Nvidia en centros de datos

La CEO de Advanced Micro Devices (AMD), Lisa Su, anunció el jueves en el evento Advancing AI en San Francisco que el sistema a escala de rack Helios de la compañía ya está en plena producción, posicionando al fabricante de chips para competir por el negocio de centros de datos de IA que Nvidia ha dominado en gran medida.

El lanzamiento marca la primera vez que AMD produce un gabinete de servidores completo diseñado para competir directamente con las ofertas de racks insignia de Nvidia. Los sistemas a escala de rack como Helios y NVL72 de Nvidia representan una tendencia creciente en el mercado de hardware de IA, donde los proveedores entregan gabinetes completamente integrados en lugar de componentes individuales, simplificando la implementación para proveedores de nube y empresas que buscan escalar rápidamente su infraestructura de IA.

Componentes del rack de servidores Helios

Helios integra 72 de las nuevas GPUs Instinct MI455X de AMD junto con las CPUs de servidor Epyc de la compañía dentro de un solo rack. Esta configuración es comparable con NVL72 de Nvidia, que de manera similar aloja 72 GPUs basadas en componentes Grace Blackwell y Vera Rubin.

Durante su discurso principal, Su describió la MI455X como la GPU más potente disponible en el mercado, una afirmación dirigida directamente al actual líder de la industria.

Según Constellation Research, que reportó desde el evento, cada MI455X cuenta con 432GB de memoria HBM4, velocidades de transferencia de datos de 23.3 TB/s y aproximadamente 320 mil millones de transistores. Un rack Helios completamente configurado puede alcanzar hasta 2.9 exaflops de cómputo FP4 máximo, 31 terabytes de memoria HBM4 y 1.7 petabytes por segundo de ancho de banda de memoria. HBM4, la última generación de memoria de alto ancho de banda, es fundamental para las cargas de trabajo de IA porque entrenar y ejecutar modelos grandes requiere mover enormes cantidades de datos entre procesadores y memoria, lo que hace que el ancho de banda de memoria sea tan importante como el cómputo bruto para determinar el rendimiento real del sistema.

Posicionamiento competitivo frente a Vera Rubin de Nvidia

Su enfatizó que el rack Helios ofrece ventajas más allá de la potencia de cómputo bruta. Afirmó que proporciona un rendimiento de cómputo 15% superior al de Vera Rubin de Nvidia, incluye 50% más memoria HBM y entrega 30% más tokens por dólar. AMD también destacó sus CPUs Epyc 9006, que según Su ofrecen un rendimiento por núcleo 20% mayor en comparación con la CPU Vera de Nvidia.

AMD persigue un mercado que Nvidia domina actualmente, con esta última manteniendo una participación estimada de entre 80% y 90% del espacio de centros de datos de IA. Más allá de las especificaciones de hardware, el dominio de Nvidia se ha visto reforzado por su ecosistema de software CUDA, en el que los desarrolladores han confiado durante años y al que la plataforma ROCm de AMD sigue desafiando. Para ayudar a cerrar esta brecha, AMD anunció una alianza con Cerebras para integrar los chips de inferencia de la firma en su línea de centros de datos, un movimiento que refleja el propio acuerdo de Nvidia con el diseñador de chips Groq. Tanto Cerebras como Groq se especializan en procesadores enfocados en inferencia que adoptan enfoques arquitectónicos distintos para ejecutar modelos de IA, lo que refleja el creciente énfasis de la industria en implementaciones eficientes en costos.

La apuesta de AMD por la inferencia

AMD está posicionando la inferencia como la próxima gran carga de trabajo computacional. Su dijo a los asistentes que aproximadamente 60% de la capacidad de cómputo se dedicará a ejecutar modelos en lugar de entrenarlos, citando a los agentes de IA como un catalizador clave de este cambio. Esto refleja la evolución de la industria desde el entrenamiento puntual de modelos hacia costos continuos de inferencia que escalan directamente con la adopción de usuarios y la implementación de aplicaciones.

Según el anuncio de lanzamiento de AMD, el consumo mensual de tokens se ha disparado 158 veces en los últimos dos años. En el modelo DeepSeek-V4-Flash, la MI455X supuestamente alcanza hasta 34 veces más rendimiento de tokens en niveles altos de interactividad.

Los reportes indican que AMD ya había asegurado acuerdos de Helios con Anthropic y Microsoft, y la compañía presentó tanto a OpenAI como a Anthropic en el escenario durante el discurso principal. Su describió la demanda de Helios como "extremadamente fuerte" y estimó el mercado de aceleradores de IA en $1.4 billones para 2030.

Las acciones de AMD cayeron más de 2% durante la presentación de Su, según Yahoo Finance. Sin embargo, en el periodo más amplio de 12 meses, las acciones de AMD han ganado 222%, frente al avance de 117% de Nvidia en el mismo lapso. AMD ha quedado rezagada frente a su rival durante años y apenas comenzó a reducir la brecha este año.