ActualitésActionsMicrosoft pourrait dévoiler la puce IA Maia 300 dès septembre

Microsoft pourrait dévoiler la puce IA Maia 300 dès septembre

Auteur: Economic Times Markets·

Points clés

  • La puce IA Maia 300 de Microsoft devrait être dévoilée dès septembre et succédera au Maia 100 annoncé en novembre 2023.
  • L'entreprise chercherait à sécuriser une capacité de production TSMC pour plus de 300 000 puces Maia 300 d'ici 2027, avec un objectif final de déploiement de plus d'un million d'unités.
  • Le développement d'accélérateurs IA propriétaires s'inscrit dans la stratégie de Microsoft visant à réduire sa dépendance aux processeurs Nvidia et à acquérir un meilleur contrôle de sa feuille de route matérielle et de ses coûts d'infrastructure.
  • Anthropic a été identifié comme un client externe potentiel pour les puces Maia 300, ce qui pourrait aider Microsoft à différencier sa plateforme Azure sur le marché compétitif des services cloud IA.
  • Les efforts de silicium personnalisé de Microsoft font suite à des initiatives similaires d'Amazon Web Services et de Google Cloud, qui ont tous deux investi massivement dans leurs propres conceptions d'accélérateurs IA sur plusieurs générations.
Microsoft pourrait dévoiler la puce IA Maia 300 dès septembre

Microsoft se prépare à dévoiler sa puce d'intelligence artificielle nouvelle génération Maia 300 dès le mois de septembre, selon un rapport récent. Le nouveau processeur représente la dernière initiative de l'entreprise pour étendre son portefeuille de silicium personnalisé destiné aux charges de travail IA hébergées dans son infrastructure cloud Azure, un domaine qui prend une importance stratégique croissante alors que l'adoption de l'IA générative entraîne une demande sans précédent de puissance de calcul dans toute l'industrie.

Le Maia 300 devrait succéder au Maia 100, que Microsoft a présenté pour la première fois lors de sa conférence Ignite en novembre 2023, en même temps que le CPU Cobalt 100. Le Maia 100 original était conçu pour accélérer l'entraînement et l'inférence des grands modèles de langage, et la nouvelle puce devrait repousser davantage les performances pour ces charges de travail exigeantes. Le Maia 100 était initialement positionné pour prendre en charge les charges de travail dans le cadre du partenariat infrastructurel croissant de Microsoft avec OpenAI, et le Maia 300 devrait élargir cette capacité à un éventail plus large de services IA hébergés sur Azure.

Selon le rapport, Microsoft prévoit de lancer le Maia 300 cet automne. L'entreprise chercherait à sécuriser une capacité de production de plus de 300 000 puces d'ici 2027, avec un objectif final de déploiement de plus d'un million d'unités Maia 300. La production serait confiée à Taiwan Semiconductor Manufacturing Company (TSMC), le partenaire fonderie établi de Microsoft pour son programme de silicium personnalisé. La capacité de packaging avancé de TSMC est devenue un goulot d'étranglement critique à l'échelle de l'industrie pour la production d'accélérateurs IA, ce qui fait des engagements anticipés auprès des fonderies un facteur compétitif clé.

Cet effort vers des accélérateurs IA propriétaires est largement perçu comme faisant partie de la stratégie de Microsoft pour réduire sa forte dépendance aux processeurs de Nvidia, qui sont devenus la norme de l'industrie pour l'entraînement et l'exécution des grands modèles d'IA, mais qui s'accompagnent de prix premium. Au plus fort de la phase de déploiement de l'IA générative, les contraintes d'approvisionnement en GPU Nvidia ont laissé de nombreux fournisseurs de cloud incapables de répondre à la demande des clients, soulignant le risque de dépendre d'un seul fournisseur. En développant des alternatives internes, Microsoft vise à réduire ses coûts d'infrastructure et à gagner davantage de contrôle sur sa feuille de route matérielle.

En plus de servir ses propres services IA internes, Microsoft cherche également à attirer d'importants clients cloud externes. Le rapport cite nommément Anthropic, la startup d'IA connue pour sa famille Claude de grands modèles de langage, comme client potentiel des nouvelles puces. Proposer une infrastructure IA personnalisée pourrait aider Microsoft à différencier sa plateforme cloud Azure sur un marché de plus en plus compétitif pour les services de calcul IA.

L'initiative de silicium personnalisé de Microsoft s'inscrit dans une tendance industrielle plus large. Plusieurs grands fournisseurs de cloud, dont Amazon Web Services avec ses puces Trainium et Inferentia et Google Cloud avec ses Tensor Processing Units (TPU), ont investi massivement dans la conception de leurs propres accélérateurs IA afin de réduire leur dépendance à l'égard de fournisseurs tiers. Google développe et déploie des TPU en interne depuis près d'une décennie, ce qui lui confère une longueur d'avance significative, tandis qu'Amazon a régulièrement étendu sa gamme de puces personnalisées sur plusieurs générations. Microsoft est entré dans ce domaine plus récemment, mais a accéléré ses efforts à mesure que les charges de travail IA devenaient centrales pour la croissance du cloud.

Source : Economic Times Markets