L'action Cerebras (CBRS) chute jusqu'à 9% après un rapport indiquant que le niveau Ultrafast d'OpenAI tourne sur des puces Nvidia
Points clés
- •Les actions Cerebras ont chuté jusqu'à 8,87% lors de la séance de mercredi, clôturant près de 180,22 $, après qu'un rapport a remis en question le rôle de la société dans l'alimentation du niveau de service IA le plus rapide d'OpenAI.
- •SemiAnalysis a indiqué que le nouveau modèle GPT-6.1 Sol Ultrafast d'OpenAI fonctionne sur des GPU Nvidia standard à faible taille de lot, plutôt que sur la puce Wafer-Scale Engine de Cerebras.
- •OpenAI a annoncé en août que le matériel Cerebras alimenterait le mode Ultrafast, un niveau promettant des vitesses jusqu'à huit fois supérieures à la normale, soit environ 300 tokens par seconde.
- •Ni Cerebras ni OpenAI n'ont publié de déclaration publique confirmant ou niant l'affirmation de SemiAnalysis, la les analystes sans orientation officielle.
- •OpenAI est le plus grand client de Cerebras en carnet de commandes, et l'action Cerebras se négocie désormais à environ la moitié de son prix d'introduction en bourse de 350 $ lors de son entrée en bourse en mai.

Les actions de Cerebras Systems Inc. (CBRS) ont reculé d'environ 7% à 9% cette semaine après qu'un rapport a soulevé des questions sur le rôle que joue encore le fabricant de puces dans l'alimentation du modèle d'IA le plus rapide d'OpenAI — un niveau de service pour lequel il avait été publiquement désigné. Le titre a plongé jusqu'à 8,87% lors de la séance de mercredi et a clôturé autour de 180,22 $, restant en baisse de près de 8% dans l'après-midi de mercredi.
Le déclic est venu de SemiAnalysis, un cabinet d'études sur les semi-conducteurs qui a indiqué dans une publication sur les réseaux sociaux que le nouveau modèle GPT-6.1 Sol Ultrafast d'OpenAI fonctionne sur des GPU Nvidia standard à faible taille de lot, et non sur le Wafer-Scale Engine phare de Cerebras.
Cette affirmation a du poids en raison de ce que Ultrafast était censé représenter. OpenAI a lancé ce niveau en promettant des vitesses jusqu'à huit fois supérieures à la normale — environ 300 tokens par seconde, la mesure standard de la vitesse à laquelle un modèle génère du texte — et a annoncé publiquement en août que le matériel Cerebras alimenterait ce mode.
Ni Cerebras ni OpenAI n'ont confirmé ni démenti l'affirmation de SemiAnalysis, et aucune des deux sociétés n'a publié de déclaration publique sur la question. Ce silence laisse les analystes dans le conjecture plutôt que de s'appuyer sur des informations officielles.
Ce que disait réellement le rapport de SemiAnalysis
Le détail décisif est une phrase enfouie dans le rapport : « faible taille de lot » (low batch size). Dans l'inférence IA, le batching consiste à regrouper les requêtes afin qu'une puce en traite beaucoup en une seule passe et fonctionne plus efficacement. Les GPU Nvidia ont généralement besoin de lots importants pour atteindre leurs performances maximales, tandis qu'une faible taille de lot signifie que moins de requêtes sont traitées à la fois, privilégiant la vitesse à l'efficacité brute.
C'est précisément le créneau sur lequel Cerebras a bâti son positionnement. Servir rapidement les utilisateurs individuels, plutôt que de traiter de longues files de requêtes, est exactement là où la société revendique un avantage. Son Wafer-Scale Engine est une puce massive qui intègre des milliards de cœurs et d'immenses réservoirs de mémoire sur une seule pièce silicium, une conception qui évite les ralentissements causés par le transfert de données entre des centaines de GPU distincts.
Si OpenAI a trouvé un moyen de faire fonctionner un modèle de premier plan sur du matériel Nvidia à faible taille de lot sans sacrifier l'efficacité des coûts, cela érode l'un des arguments de vente centraux de Cerebras — ce qui explique pourquoi les traders ont réagi si vite.
Une chute abrupte depuis l'introduction en bourse
Cerebras est entrée en bourse en mai à un prix d'introduction de 350 $, et le titre a peiné depuis. Aux niveaux de mercredi, les actions s'échangeaient à environ la moitié de leur prix de début. L'introduction s'accompagnait d'un battage considérable : les investisseurs étaient attirés par une société de puces affirmant pouvoir surpasser Nvidia en vitesse d'inférence brute pour certaines charges de travail. Cet enthousiasme s'est depuis refroidi, et les rapports de résultats après l'introduction n'ont pas été à la hauteur de l'engouement affiché par les investisseurs le premier jour.
Pourquoi l'implication d'OpenAI compte tant
OpenAI n'est pas un client ordinaire pour Cerebras. C'est le plus grand client de la société en carnet de commandes, selon Barron's, et Cerebras s'est fortement appuyée sur cette relation pour justifier sa valorisation. Perdre du terrain avec OpenAI, même temporairement, soulève donc de réelles questions pour les investisseurs.
Il existe également une possibilité que la situation ne soit pas définitive. Des contraintes de capacité ou des problèmes d'optimisation technique pourraient expliquer pourquoi des puces Nvidia gèrent actuellement la charge de travail, et Cerebras pourrait finir par alimenter le mode Ultrafast à l'avenir, une fois les problèmes techniques résolus. Rien de ce qui a été déclaré par les deux sociétés ne l'exclut.
Pour l'heure, la réaction du titre reflète l'incertitude plus qu'une mauvaise nouvelle confirmée. Les investisseurs intègrent le risque que l'écosystème logiciel CUDA dominant de Nvidia et ses améliorations matérielles continues rendent difficile pour tout challenger la conclusion d'accords exclusifs avec les grands laboratoires d'IA. Cerebras n'a publié aucune déclaration confirmant ou niant son rôle actuel dans les plans d'infrastructure d'OpenAI. Jusqu'à ce que l'une des deux sociétés brise son silence, tout commentaire officiel — ou toute divulgation précisant quel matériel sert Ultrafast — serait le moyen le plus direct d'établir si le rapport reflète un changement durable ou un arrangement temporaire.
Cet article est d'abord paru sur CoinCentral.