ActualitésActionsAMD lance le rack serveur IA Helios pour défier directement la domination de Nvidia dans les centres de données

AMD lance le rack serveur IA Helios pour défier directement la domination de Nvidia dans les centres de données

Auteur: Cryptopolitan·

Points clés

  • Helios est le premier rack serveur entièrement intégré d’AMD conçu pour concurrencer les systèmes phares de centres de données IA de Nvidia.
  • Le système comprend 72 GPU Instinct MI455X et des CPU serveurs Epyc, avec un rack entièrement configuré offrant jusqu’à 2.9 exaflops de calcul FP4 de pointe.
  • AMD a déclaré qu’Helios fournit des performances de calcul supérieures de 15%, 50% de mémoire HBM en plus et 30% de tokens supplémentaires par dollar par rapport au Vera Rubin de Nvidia.
  • AMD a annoncé un partenariat avec Cerebras pour ajouter des puces axées sur l’inférence à son portefeuille de centres de données.
  • Les actions AMD ont chuté de plus de 2% pendant la présentation de Su, même si le titre a progressé de 222% au cours des 12 derniers mois.
AMD lance le rack serveur IA Helios pour défier directement la domination de Nvidia dans les centres de données

La CEO d’Advanced Micro Devices (AMD), Lisa Su, a annoncé jeudi lors de l’événement Advancing AI à San Francisco que le système à l’échelle du rack Helios de l’entreprise est désormais en pleine production, positionnant le fabricant de puces pour concurrencer Nvidia sur le marché des centres de données IA, que ce dernier domine largement.

Ce lancement marque la première fois qu’AMD produit un cabinet serveur complet conçu pour rivaliser directement avec les offres en rack phares de Nvidia. Les systèmes à l’échelle du rack comme Helios et le NVL72 de Nvidia illustrent une tendance croissante du marché du matériel IA, où les fournisseurs livrent des cabinets entièrement intégrés plutôt que des composants individuels, simplifiant le déploiement pour les fournisseurs cloud et les entreprises qui cherchent à étendre rapidement leur infrastructure IA.

Composants du rack serveur Helios

Helios intègre 72 des nouveaux GPU Instinct MI455X d’AMD aux côtés des CPU serveurs Epyc de l’entreprise dans un seul rack. Cette configuration est comparable au NVL72 de Nvidia, qui accueille également 72 GPU basés sur des composants Grace Blackwell et Vera Rubin.

Lors de son discours d’ouverture, Su a décrit le MI455X comme le GPU le plus puissant disponible sur le marché — une affirmation clairement adressée au leader actuel du secteur.

Selon Constellation Research, qui couvrait l’événement, chaque MI455X dispose de 432GB de mémoire HBM4, de vitesses de transfert de données de 23.3 TB/s et d’environ 320 milliards de transistors. Un rack Helios entièrement configuré peut atteindre jusqu’à 2.9 exaflops de calcul FP4 de pointe, 31 téraoctets de mémoire HBM4 et 1.7 pétaoctet par seconde de bande passante mémoire. La HBM4, dernière génération de mémoire à large bande passante, est essentielle pour les charges de travail IA, car l’entraînement et l’exécution de grands modèles exigent de déplacer d’énormes volumes de données entre les processeurs et la mémoire, ce qui rend la bande passante mémoire aussi importante que la puissance de calcul brute pour déterminer les performances réelles d’un système.

Positionnement concurrentiel face au Vera Rubin de Nvidia

Su a souligné que le rack Helios offre des avantages au-delà de la seule puissance de calcul brute. Elle a déclaré qu’il fournit des performances de calcul supérieures de 15% à celles du Vera Rubin de Nvidia, embarque 50% de mémoire HBM en plus et génère 30% de tokens supplémentaires par dollar. AMD a également mis en avant ses CPU Epyc 9006, dont Su a indiqué qu’ils offrent des performances par cœur supérieures de 20% à celles du CPU Vera de Nvidia.

AMD vise un marché actuellement dominé par Nvidia, ce dernier détenant une part estimée entre 80% et 90% de l’espace des centres de données IA. Au-delà des caractéristiques matérielles, la domination de Nvidia a été renforcée par son écosystème logiciel CUDA, sur lequel les développeurs s’appuient depuis des années et que la plateforme ROCm d’AMD continue de défier. Pour aider à réduire cet écart, AMD a annoncé un partenariat avec Cerebras afin d’intégrer les puces d’inférence de l’entreprise à sa gamme de centres de données — une démarche qui fait écho au propre accord de Nvidia avec le concepteur de puces Groq. Cerebras et Groq sont tous deux spécialisés dans des processeurs axés sur l’inférence qui adoptent des approches architecturales différentes pour exécuter des modèles IA, reflétant l’importance croissante accordée par l’industrie au déploiement rentable.

Le pari d’AMD sur l’inférence

AMD positionne l’inférence comme la prochaine grande charge de travail informatique. Su a déclaré aux participants qu’environ 60% de la capacité de calcul sera consacrée à l’exécution des modèles plutôt qu’à leur entraînement, citant les agents IA comme un catalyseur clé de ce basculement. Cela reflète l’évolution du secteur, qui passe d’un entraînement ponctuel des modèles à des coûts d’inférence continus évoluant directement avec l’adoption par les utilisateurs et le déploiement des applications.

Selon l’annonce de lancement d’AMD, la consommation mensuelle de tokens a été multipliée par 158 au cours des deux dernières années. Sur le modèle DeepSeek-V4-Flash, le MI455X atteindrait jusqu’à 34 fois plus de débit de tokens à des niveaux d’interactivité élevés.

Des rapports indiquent qu’AMD avait déjà conclu des accords Helios avec Anthropic et Microsoft, et l’entreprise a fait intervenir OpenAI et Anthropic sur scène lors du discours d’ouverture. Su a décrit la demande pour Helios comme « extrêmement forte » et a estimé le marché des accélérateurs IA à $1.4 trillion d’ici 2030.

Les actions AMD ont reculé de plus de 2% pendant la présentation de Su, selon Yahoo Finance. Sur une période plus large de 12 mois, toutefois, l’action AMD a progressé de 222%, contre une hausse de 117% pour Nvidia sur la même période. AMD est restée derrière son rival pendant des années et n’a commencé à réduire l’écart que cette année.