НовостиАкцииАкции Cerebras (CBRS) упали на 9% после отчета о том, что тариф OpenAI Ultrafast работает на чипах Nvidia

Акции Cerebras (CBRS) упали на 9% после отчета о том, что тариф OpenAI Ultrafast работает на чипах Nvidia

Автор: Coincentral·

Ключевые выводы

  • •Акции Cerebras в среду падали на 8,87%, закрывшись около $180,22, после того как отчет поставил под вопрос роль компании в обеспечении работы самого быстрого тарифа ИИ-сервиса OpenAI.
  • •По данным SemiAnalysis, новая модель OpenAI GPT-6.1 Sol Ultrafast работает на стандартных GPU Nvidia при малом размере батча, а не на чипе Cerebras Wafer-Scale Engine.
  • •В августе OpenAI объявила, что режим Ultrafast будет работать на оборудовании Cerebras; тариф обещает скорость до восьми раз выше обычной — около 300 токенов в секунду.
  • •Ни Cerebras, ни OpenAI не сделали публичных заявлений, подтверждающих или опровергающих утверждение SemiAnalysis, оставив аналитиков без официальных ориентиров.
  • •OpenAI — крупнейший клиент Cerebras по выручке, а акции Cerebras сейчас торгуются примерно вдвое ниже цены IPO $350 с майского размещения.
Акции Cerebras (CBRS) упали на 9% после отчета о том, что тариф OpenAI Ultrafast работает на чипах Nvidia

Акции Cerebras Systems Inc. (CBRS) упали примерно на 7–9% на этой неделе после того, как отчет поставил под вопрос, сохраняет ли производитель чипов роль в обеспечении работы самой быстрой модели OpenAI — уровня сервиса, поддержку которого компания публично называла своей задачей. В среду акции падали на 8,87%, закрывшись около $180,22, и к середине дня оставались в минусе почти на 8%.

Толчком послужил пост исследовательской компании SemiAnalysis в социальных сетях, в котором утверждалось, что новая модель OpenAI GPT-6.1 Sol Ultrafast работает на стандартных GPU Nvidia при малом размере батча, а не на флагманском чипе Cerebras Wafer-Scale Engine.

Это утверждение имеет большое значение из-за того, что должен был означать тариф Ultrafast. OpenAI запустила его с обещанием скорости до восьми раз выше обычной — примерно 300 токенов в секунду (стандартная мера скорости генерации текста моделью) — и в августе публично объявила, что этот режим будет работать на оборудовании Cerebras.

Ни Cerebras, ни OpenAI не подтвердили и не опровергли заявление SemiAnalysis, и ни одна из компаний не сделала официальных публичных заявлений. Молчание оставляет аналитиков в догадках, не опираясь на официальные данные.

Что говорится в отчете SemiAnalysis

Ключевая деталь — фраза, скрытая в отчете: «низкий размер батча». При инференсе ИИ батчинг означает группировку запросов, чтобы чип обрабатывал множество из них за один проход и работал эффективнее. GPU Nvidia обычно требуют больших батчей для достижения пиковой производительности, тогда как малый размер батча означает обработку меньшего числа запросов одновременно — в ущерб сырой эффективности, но в пользу скорости.

Именно эта ниша была центральным элементом маркетинга Cerebras. Быстрое обслуживание отдельных пользователей, а не работа с большими очередями запросов, — именно здесь компания заявляла о своем преимуществе. Ее Wafer-Scale Engine — это огромный чип, вмещающий миллиарды ядер и обширные пулы памяти на одном кристалле кремния; такая конструкция позволяет избежать замедлений, вызванных передачей данных между сотнями отдельных GPU.

Если OpenAI нашла способ запускать топовую модель на оборудовании Nvidia при малом размере батча без потери экономической эффективности, это подрывает один из главных аргументов Cerebras — что и объясняет быструю реакцию трейдеров.

Крутой спад после IPO

Cerebras вышла на биржу в мае по цене IPO $350, и с тех пор акции испытывают трудности. На уровнях среды они торговались примерно вдвое ниже цены дебюта. Размещение сопровождалось значительным ажиотажем: инвесторов привлекла чиповая компания, заявлявшая, что по скорости инференса она способна превзойти Nvidia для определенных рабочихок. С тех пор энтузиазм остыл, а отчетные публикации после IPO не оправдали ожиданий первого дня.

Почему участие OpenAI имеет такое значение

OpenAI — не просто еще один клиент для Cerebras. По данным Barron's, это крупнейший клиент компании по выручке, и Cerebras в значительной мере опирается на эти отношения для обоснования своей оценки. Потеря позиций в работе с OpenAI, даже временная, поэтому вызывает у инвесторов серьезные вопросы.

Есть и вероятность, что ситуация не является постоянной. Ограничения по мощностям или вопросы технической оптимизации могут объяснять, почему сейчас нагрузку обрабатывают чипы Nvidia, и Cerebras в будущем все же может обеспечивать работу режима Ultrafast после устранения технических недоработок. Ничего из заявлений компаний этого не исключает.

Пока что реакция акций отражает скорее неопределенность, чем подтвержденные плохие новости. Инвесторы закладывают риск того, что доминирующая программная экосистема CUDA от Nvidia и продолжающееся совершенствование оборудования затрудняют любому конкуренту заключение эксклюзивных сделок с крупными ИИ-лабораториями. Cerebras не сделала никаких заявлений, подтверждающих или опровергающих ее текущую роль в планах OpenAI по инфраструктуре. Пока одна из двух компаний не нарушит молчание, любой официальный комментарий — или раскрытие информации о том, какое оборудование обслуживает Ultrafast, — станет самым прямым способом установить, отражает ли отчет долгосрочное изменение или временное решение.

Впервые статья была опубликована на CoinCentral.