报道称OpenAI Ultrafast层由Nvidia芯片驱动,Cerebras(CBRS)股价一度下跌9%
要点速览
- •一份报告质疑Cerebras在为OpenAI最快AI服务层提供支持方面的角色后,该股周三交易时段最大跌幅达8.87%,收于约180.22美元。
- •SemiAnalysis表示,OpenAI最新的GPT-6.1 Sol Ultrafast模型正以低批次规模运行于标准Nvidia GPU上,而非Cerebras的晶圆级引擎芯片。
- •OpenAI曾在8月宣布由Cerebras硬件为Ultrafast模式提供支持,该层承诺速度最高可达常规的八倍,约每秒300个token。
- •Cerebras和OpenAI均未发表任何公开声明证实或否认SemiAnalysis的说法,使分析师缺乏官方指引。
- •OpenAI是Cerebras按收入积压计算的最大客户,且Cerebras股票目前的交易价格约为其5月上市时350美元IPO价格的一半。

Cerebras Systems Inc.(CBRS)股价本周一度下跌约7%至9%,原因是一份报告质疑这家芯片制造商是否仍在为OpenAI最快的AI模型提供支持——而此前该公司曾公开被点名为该服务层提供支持。该股在周三交易时段最大跌幅达8.87%,收于约180.22美元,截至周三下午仍下跌近8%。
导火索来自半导体研究机构SemiAnalysis,其在一则社交媒体帖子中表示,OpenAI最新的GPT-6.1 Sol Ultrafast模型正以低批次规模运行于标准Nvidia GPU上,而非Cerebras的旗舰级晶圆级引擎(Wafer-Scale Engine)芯片。
这一说法之所以分量十足,是因为Ultrafast本应代表的正是速度优势。OpenAI推出该服务层时承诺速度最高可达常规的八倍——约每秒300个token,这是衡量模型生成文本速度的标准指标——并于8月公开宣布将由Cerebras硬件为该模式提供支持。
Cerebras和OpenAI均未证实或否认SemiAnalysis的说法,两家公司也未就此发表任何公开声明。这种沉默使分析师只能猜测,而无官方信息可依。
SemiAnalysis报告究竟说了什么
报告中的关键细节是一个措辞:"低批次规模"(low batch size)。在AI推理中,批处理指的是将多个请求组合在一起,使芯片在一次处理中完成多个请求,从而提高运行效率。Nvidia GPU通常需要较大的批次才能达到峰值性能,而低批次规模意味着一次处理的请求较少,以速度优先而非原始效率。
这正是Cerebras一直围绕其进行市场定位的细分领域。快速服务单个用户,而非处理大量排队的请求,正是该公司声称拥有优势的地方。其晶圆级引擎是一块巨型芯片,可将数十亿个核心和海量内存池集成到单块硅片上,这种设计避免了在数百个独立GPU之间搬运数据所导致的性能瓶颈。
如果OpenAI已经找到在Nvidia硬件上以低批次规模运行顶级模型且不牺牲成本效率的方法,那将侵蚀Cerebras的核心卖点之一——这也有助于解释交易员的反应为何如此迅速。
较IPO价格的大幅下滑
Cerebras于5月以350美元的IPO价格上市,此后股价持续承压。以周三的价格水平计算,股价交投于其首发价格的大约一半。此次上市曾伴随大量炒作:投资者看好这家声称在某些工作负载的原始推理速度上能超越Nvidia的芯片公司。此后这股热情已经降温,IPO之后的财报表现也未能达到投资者首日展现的兴奋程度。
OpenAI的参与为何如此重要
对Cerebras而言,OpenAI并非普通客户。据Barron's报道,OpenAI是该公司按收入积压计算的最大客户,而Cerebras也高度依赖这层关系来支撑其估值。因此,即便只是暂时失去OpenAI的支持,也会给投资者带来切实的疑虑。
这种局面也有可能并非永久性的。产能限制或技术问题可以解释为何Nvidia芯片目前承担了这一工作负载,而一旦技术问题得到解决,Cerebras未来仍有可能为Ultrafast模式提供支持。目前没有任何来自两家公司的信息排除这种可能。
就目前而言,股价反应更多体现的是不确定性,而非已证实的坏消息。投资者正在消化这样一种风险:Nvidia占据主导地位的CUDA软件生态系统及其持续的硬件改进,将使任何挑战者都难以与大型AI实验室锁定独家合作。Cerebras尚未就其在OpenAI基础设施规划中的当前角色发表任何确认或否认的声明。在两家公司中的任何一方打破沉默之前,任何官方表态——或澄清由哪种硬件为Ultrafast提供服务的披露——都将是判断该报告反映的是持久变化还是临时安排的最直接依据。
本文最初发表于CoinCentral。