AMD 宣布與 Cerebras Systems 建立 AI 推論合作後股價反彈
重點速覽
- •AMD 與 Cerebras 開發了一個 AI 推論平台,結合 AMD Helios 機架級系統與 Cerebras Wafer-Scale Engine。
- •該平台將提示處理與代幣生成分離,並把每個階段分配給專用硬體。
- •兩家公司預期,該架構相較現有解決方案可實現最多五倍的每瓦每秒代幣數。
- •Cerebras 計劃在其資料中心部署 AMD Helios 系統,並於 2026 年下半年透過 Cerebras Cloud 推出該產品。
- •AMD 股價在常規交易時段下跌 2.29% 後,盤後交易上漲 1.54%。

Advanced Micro Devices (AMD) 股價在盤後交易中反彈,此前公司宣布與 Cerebras Systems 建立技術合作,目標是推出高效能 AI 推論平台。
AMD 股價在常規交易時段收於 $539.69,下跌 2.29%,隨後在盤後交易中上漲 1.54% 至 $548.00。這一回升發生在公司於 Advancing AI 2026 活動期間公布與 Cerebras 合作之後。
AMD 與 Cerebras 推出分散式 AI 推論平台
AMD 與 Cerebras Systems 共同開發了一項新的 AI 推論解決方案,整合 AMD Helios 機架級系統與 Cerebras Wafer-Scale Engine。該平台旨在提升推論速度、能源效率,以及在高需求企業工作負載中的大規模部署能力。
此次合作的核心是一種分散式架構,可在單一推論工作流程中將提示處理與代幣生成分離。AMD Helios 負責高吞吐量的提示執行並管理大型上下文視窗,而 Cerebras Wafer-Scale Engine 則以超低延遲加速代幣生成。
兩家公司預期,與現有解決方案相比,這一組合架構可將每瓦每秒代幣數提高最多五倍。這項效率提升旨在同時應對現代 AI 應用對效能與功耗的需求;隨著資料中心營運商擴展 AI 基礎設施,耗電量與冷卻已成為關鍵限制因素。
瞄準即時 AI 應用
這一設計反映了 AI 推論領域正在形成的現實:不同運算任務需要不同的基礎設施。部分部署優先考量大量請求的最大吞吐量,而其他應用——例如程式碼工具、自主代理和即時助理——則需要顯著更快的回應時間。
在新平台下,每個工作負載階段都會被分配到專用硬體。AMD Helios 以機架級吞吐量處理提示,Cerebras Wafer-Scale Engine 則以較低延遲處理記憶體密集型的代幣生成。兩家公司表示,更快的代幣生成可改善互動式工作負載中的回應品質,使該架構適用於軟體開發、機器人、科學研究和自主系統。
這一方法使 AMD 與 Cerebras 一同成為以 GPU 為中心的主流推論範式的挑戰者,透過互補架構發揮優勢,而不是僅在通用加速器效能上競爭。
透過 Cerebras Cloud 部署
Cerebras 計劃在其資料中心基礎設施中部署 AMD Helios 系統。這項聯合產品預計將於 2026 年下半年透過 Cerebras Cloud 推出,進一步擴大 AMD 最新 AI 基礎設施產品的商業覆蓋範圍。
該公告強化了 AMD 從 AI 訓練拓展至推論運算市場的策略。隨著各組織部署更大型的生產級 AI 系統,對推論最佳化基礎設施的需求持續成長,推動硬體供應商轉向專用平台,而非通用處理。隨著生成式 AI 應用從開發進入生產部署,推論領域普遍被預期將占 AI 運算支出的更大比重。
此次合作也凸顯產業更廣泛地轉向異質運算架構的趨勢,企業透過結合專用處理器來提升不同 AI 工作負載的效率。AMD 盤後股價回升,反映市場對公司擴大 AI 基礎設施策略的反應。