NoticiasAccionesAMD adquiere Taalas para acelerar sus capacidades de inferencia de IA

AMD adquiere Taalas para acelerar sus capacidades de inferencia de IA

Autor: Blockonomi·

Puntos clave

  • AMD ha acordado adquirir Taalas, una startup de chips de inferencia de IA con sede en Toronto, fundada en 2023, que ha recaudado $219 millones en financiación total.
  • Los procesadores de Taalas integran los pesos del modelo directamente en el silicio, lo que reduce la dependencia de la memoria de ancho de banda alto y logra aproximadamente 17.000 tokens por segundo en el modelo de ocho mil millones de parámetros Llama 3.1 de Meta en pruebas de referencia iniciales.
  • AMD tiene la intención de integrar la tecnología de Taalas con sus GPU Instinct, procesadores EPYC, sistemas Helios a escala de rack y software ROCm para ofrecer configuraciones más especializadas para cargas de trabajo de inferencia de alto volumen.
  • La adquisición refleja un cambio generalizado en la industria de los semiconductores hacia la computación optimizada para inferencia, tras la adquisición de los activos de Groq por $20.000 millones por parte de Nvidia en diciembre de 2025.
  • AMD espera que la transacción de Taalas se cierre durante el cuarto trimestre de 2026, sujeta a aprobación regulatoria.
AMD adquiere Taalas para acelerar sus capacidades de inferencia de IA

AMD ha acordado adquirir Taalas, una startup con sede en Toronto especializada en procesadores diseñados para modelos específicos de inferencia de IA, a medida que el fabricante de chips profundiza su incursión en la computación especializada para satisfacer la creciente demanda de IA comercial.

Las acciones de AMD (AMD) cayeron un 1,21% hasta los $483,36 en el cierre del viernes, y luego se depreciaron un 0,12% adicional en operaciones después de horas hasta los $482,80.

Tecnología de Taalas y planes de integración

AMD afirmó que la adquisición incorporará la tecnología de Taalas a su hoja de ruta más amplia de aceleradores y sistemas. Taalas diseña procesadores que integran los pesos del modelo directamente en el silicio, lo que reduce la dependencia de la memoria de ancho de banda alto. La memoria de ancho de banda alto ha sido uno de los componentes con mayor restricción de suministro en la cadena de abastecimiento de aceleradores de IA, y reducir la dependencia de ella podría disminuir los costos de producción y aliviar los cuellos de botella de aprovisionamiento en implementaciones a gran escala. Este enfoque tiene como objetivo mejorar la velocidad y la eficiencia en modelos con arquitecturas estables y demandas intensas de inferencia.

La startup probó su chip HC1 utilizando el modelo de ocho mil millones de parámetros Llama 3.1 de Meta, y reportó un rendimiento de aproximadamente 17.000 tokens por segundo en los primeros resultados de pruebas de referencia publicados en febrero. Sin embargo, la arquitectura sacrifica flexibilidad a cambio de rendimiento, ya que cada procesador está diseñado para un modelo específico en lugar de admitir diversas cargas de trabajo. Esto significa que los clientes tendrían que comprometerse con una arquitectura de modelo particular para beneficiarse de las ganancias de rendimiento, una apuesta a que los diseños de los modelos permanezcan suficientemente estables durante un ciclo de implementación de hardware.

AMD tiene la intención de combinar la tecnología de Taalas con sus GPU Instinct, procesadores EPYC, sistemas Helios y software ROCm. Esto podría permitir que el procesamiento de prompts y la generación de tokens se manejen en diferentes tipos de procesadores, lo que permitiría a AMD ofrecer a los clientes configuraciones más especializadas para cargas de trabajo de inferencia de alto volumen.

Estrategia Helios a escala de rack

La adquisición refuerza el esfuerzo más amplio de AMD por ofrecer sistemas de IA completos a escala de rack para los principales clientes de la nube. AMD comenzó recientemente a enviar sistemas Helios diseñados para competir directamente con las plataformas de servidores integrados de Nvidia. Meta y Microsoft ya se han comprometido con implementaciones que utilizan la infraestructura a escala de rack de AMD.

Taalas podría introducir una capa de inferencia dedicada dentro de futuras configuraciones de Helios, donde las GPU manejarían tareas de computación flexible mientras que los aceleradores específicos para modelos procesarían las cargas de trabajo repetitivas de generación de tokens. Esta configuración podría mejorar la eficiencia del sistema para los clientes que ejecutan modelos grandes a volúmenes altos y predecibles.

AMD ha expandido su cartera de IA a través de múltiples adquisiciones en los últimos dos años, incluyendo Silo AI por $665 millones y ZT Systems por $4.900 millones. La empresa también ha adquirido empresas de software más pequeñas, como el especialista en inferencia MK1, para fortalecer las capacidades de su plataforma. La acumulación de activos de hardware, integración de sistemas y software refleja el esfuerzo de AMD por cerrar la brecha con la pila verticalmente integrada de Nvidia, que combina GPU con su ecosistema de software CUDA que ha dominado los flujos de trabajo de desarrollo de IA.

Cambio generalizado de la industria hacia la inferencia

El acuerdo de Taalas se produce en medio de una reasignación generalizada de recursos en la industria hacia la inferencia de IA en lugar del entrenamiento de modelos únicamente. A medida que más empresas trasladan sus modelos de IA desde la fase de desarrollo hacia servicios en producción que atienden a usuarios finales, la computación de inferencia está representando una proporción mayor del gasto total en infraestructura de IA. Los servicios de IA comerciales exigen cada vez más tiempos de respuesta más rápidos, menores costos operativos y mayor rendimiento a medida que crecen las bases de usuarios. Los procesadores especializados pueden satisfacer estos requisitos cuando los clientes ejecutan los mismos modelos de forma repetida a gran escala.

Nvidia hizo un movimiento comparable en diciembre de 2025, al adquirir los activos de Groq por $20.000 millones, una transacción que puso de relieve la creciente importancia estratégica de la tecnología de inferencia de alta velocidad en todo el sector de los semiconductores. La adquisición de Taalas por parte de AMD sigue la misma tendencia, pero introduce una arquitectura diferente y específica para modelos.

Taalas ha recaudado $219 millones desde su fundación en 2023 y continúa desarrollando su procesador HC2 de segunda generación, diseñado para admitir modelos de hasta 20.000 millones de parámetros.

AMD espera que la transacción se cierre durante el cuarto trimestre de 2026, sujeta a aprobación regulatoria.