AMD拟收购Taalas以加速AI推理能力
要点速览
- •AMD已同意收购Taalas,这是一家2023年成立、总部位于多伦多的AI推理芯片初创公司,累计融资2.19亿美元。
- •Taalas处理器将模型权重直接嵌入硅片中,降低了对高带宽存储器的依赖,在早期基准测试中使用Meta的Llama 3.1八十亿参数模型实现了约每秒17,000个token的吞吐量。
- •AMD计划将Taalas技术与其Instinct GPU、EPYC处理器、Helios机架级系统和ROCm软件整合,为高吞吐量推理工作负载提供更专业的配置。
- •此次收购反映了半导体行业向推理优化计算更广泛的转型,此前Nvidia于2025年12月以200亿美元收购了Groq资产。
- •AMD预计Taalas交易将于2026年第四季度完成,尚需监管批准。

AMD已同意收购总部位于多伦多的初创公司Taalas,该公司专注于面向AI推理工作负载的模型专用处理器。此举表明这家芯片制造商正进一步深耕专用计算领域,以满足日益增长的商用AI需求。
AMD(AMD)股价在周五收盘时下跌1.21%至483.36美元,随后在盘后交易中进一步下跌0.12%至482.80美元。
Taalas技术与整合计划
AMD表示,此次收购将把Taalas技术纳入其更广泛的加速器和系统路线图。Taalas设计的处理器将模型权重直接嵌入硅片中,降低了对高带宽存储器的依赖。高带宽存储器一直是AI加速器供应链中供应最紧张的组件之一,减少对其依赖可降低生产成本并缓解大规模部署中的采购瓶颈。该方法旨在提高具有稳定架构和大量推理需求的模型的速度和效率。
该初创公司使用Meta的Llama 3.1八十亿参数模型测试了其HC1芯片,在2月发布的早期基准测试结果中报告了约每秒17,000个token的吞吐量。然而,该架构以灵活性换取性能,因为每个处理器都是为特定模型量身定制的,而非支持多种工作负载。这意味着客户需要承诺使用特定的模型架构才能受益于性能提升,这押注于模型设计在硬件部署周期内保持足够的稳定性。
AMD计划将Taalas技术与Instinct GPU、EPYC处理器、Helios系统和ROCm软件相结合。这可能使提示处理和token生成由不同类型的处理器分别完成,从而让AMD能够为客户提供更适合高吞吐量推理工作负载的专用配置。
Helios机架级战略
此次收购巩固了AMD为主要云客户提供完整机架级AI系统的更广泛努力。AMD最近开始出货Helios系统,旨在直接与Nvidia的集成服务器平台竞争。Meta和Microsoft已承诺使用AMD的机架级基础设施进行部署。
Taalas可以在未来的Helios配置中引入专用推理层,其中GPU负责灵活的计算任务,而模型专用加速器处理重复的token生成工作负载。这种设置可以提高在可预测的大规模条件下运行大型模型的客户的系统效率。
AMD在过去两年中通过多次收购扩大了其AI产品组合,包括以6.65亿美元收购Silo AI和以49亿美元收购ZT Systems。该公司还收购了包括推理专家MK1在内的较小型软件公司,以增强其平台能力。硬件、系统集成和软件资产的积累反映了AMD努力缩小与Nvidia垂直集成技术栈之间差距的决心,Nvidia的技术栈将GPU与其主导AI开发工作流程的CUDA软件生态系统配对使用。
全行业向推理转型
Taalas交易正值全行业将更多资源从单纯的模型训练重新分配至AI推理之际。随着越来越多的公司将AI模型从开发阶段转向为终端用户提供服务的生产环境,推理计算正在成为AI基础设施总支出的更大份额。商用AI服务对更快响应时间、更低运营成本和更大用户群下的更高吞吐量的需求日益增长。当客户以大规模重复运行相同模型时,专用处理器可以满足这些需求。
Nvidia在2025年12月采取了类似举措,以200亿美元收购了Groq资产,这笔交易突显了高速推理技术在半导体行业中日益增长的战略重要性。AMD收购Taalas遵循了相同的趋势,但引入了不同的模型专用架构。
Taalas自2023年成立以来已融资2.19亿美元,并继续开发其第二代HC2处理器,该处理器设计支持高达200亿参数的模型。
AMD预计该交易将于2026年第四季度完成,尚需获得监管批准。