AMD neemt Taalas over om AI-inferentiemogelijkheden te versnellen
Belangrijkste punten
- •AMD heeft een overeenkomst bereikt om Taalas over te nemen, een in Toronto gevestigde AI-inferentie-chipstartup die in 2023 is opgericht en in totaal $219 miljoen aan financiering heeft opgehaald.
- •Taalas-processoren embedden modelgewichten direct in silicium, waardoor de afhankelijkheid van high-bandwidth memory afneemt en ongeveer 17.000 tokens per seconde wordt behaald op het achtmiljard-parametersmodel Llama 3.1 van Meta in vroege benchmarks.
- •AMD is voornemens de technologie van Taalas te integreren met zijn Instinct GPU's, EPYC-processoren, Helios rack-scale-systemen en ROCm-software om meer gespecialiseerde configuraties te bieden voor inferentie-workloads met een hoog volume.
- •De overname weerspiegelt een bredere verschuiving in de halfgeleiderindustrie naar inferentie-geoptimaliseerde computing, na de overname van Groq-activa door Nvidia voor $20 miljard in december 2025.
- •AMD verwacht dat de Taalas-transactie wordt afgesloten tijdens het vierde kwartaal van 2026, onder voorbehoud van goedkeuring door de toezichthouders.

AMD heeft een overeenkomst bereikt om Taalas over te nemen, een in Toronto gevestigde startup die gespecialiseerd is in modelspecifieke processoren voor AI-inferentie-workloads, terwijl de chipmaker haar inzet voor gespecialiseerde computing vergroot in antwoord op de groeiende commerciële AI-vraag.
Het aandeel AMD (AMD) daalde 1,21% naar $483,36 bij de sluiting op vrijdag, en zakte vervolgens nog eens 0,12% in de handel na sluitingstijd naar $482,80.
Taalas-technologie en integratieplannen
AMD verklaarde dat de overname de technologie van Taalas zal toevoegen aan haar bredere roadmap voor versnellers en systemen. Taalas ontwerpt processoren die modelgewichten direct in silicium inbedden, waardoor de afhankelijkheid van high-bandwidth memory afneemt. High-bandwidth memory behoort tot de schaarsste componenten in de toeleveringsketen voor AI-versnellers, en het verminderen van de afhankelijkheid ervan kan de productiekosten verlagen en inkoopknelpunten voor grootschalige uitrolingen verminderen. De aanpak is bedoeld om de snelheid en efficiëntie te verbeteren voor modellen met stabiele architecturen en zware inferentievereisten.
De startup testte zijn HC1-chip met het achtmiljard-parametersmodel Llama 3.1 van Meta, en rapporteerde een doorvoer van ongeveer 17.000 tokens per seconde in vroege benchmarkresultaten die in februari werden gepubliceerd. De architectuur biedt echter wel minder flexibiliteit in ruil voor prestaties, aangezien elke processor is afgestemd op een specifiek model in plaats van diverse workloads te ondersteunen. Dit betekent dat klanten zich zouden moeten committeren aan een bepaalde modelarchitectuur om te profiteren van de prestatieverbeteringen, een inzet die erop vertrouwt dat modelontwerpen voldoende stabiel blijven gedurende de levenscyclus van een hardware-uitrol.
AMD is voornemens de technologie van Taalas te combineren met Instinct GPU's, EPYC-processoren, Helios-systemen en ROCm-software. Dit zou het mogelijk maken om promptverwerking en tokengeneratie door verschillende soorten processoren te laten afhandelen, waardoor AMD klanten meer gespecialiseerde configuraties kan bieden voor inferentie-workloads met een hoog volume.
Helios rack-scale-strategie
De overname versterkt de bredere inspanning van AMD om complete rack-scale AI-systemen te leveren voor grote cloudklanten. AMD is recentelijk begonnen met de levering van Helios-systemen die bedoeld zijn om direct te concurreren met de geïntegreerde serverplatforms van Nvidia. Meta en Microsoft hebben zich al verbonden aan uitrolingen met behulp van de rack-scale-infrastructuur van AMD.
Taalas zou een toegewijde inferentielaag kunnen introduceren binnen toekomstige Helios-configuraties, waarbij GPU's flexibele rekentaken uitvoeren en modelspecifieke versnellers herhaalde tokengeneratie-workloads verwerken. Een dergelijke opzet kan de efficiëntie van het systeem verbeteren voor klanten die grote modellen draaien op hoge en voorspelbare volumes.
AMD heeft haar AI-portfolio de afgelopen twee jaar uitgebreid via meerdere overnames, waaronder Silo AI voor $665 miljoen en ZT Systems voor $4,9 miljard. Het bedrijf heeft ook kleinere softwarebedrijven overgenomen, zoals inferentiespecialist MK1, om zijn platformmogelijkheden te versterken. De opeenstapeling van hardware-, systeemintegratie- en software-activa weerspiegelt de inspanning van AMD om de kloof te dichten met de verticaal geïntegreerde stack van Nvidia, die GPU's paart aan zijn CUDA-software-ecosysteem dat AI-ontwikkelingsworkflows heeft gedomineerd.
Bredere industriele verschuiving naar inferentie
De deal met Taalas komt te midden van een bredere herverdeling van middelen in de industrie naar AI-inferentie in plaats van uitsluitend modeltraining. Naarmate meer bedrijven AI-modellen van ontwikkeling naar productiediensten voor eindgebruikers verplaatsen, wordt inferentie-rekenkracht een groter aandeel van de totale AI-infrastructuuruitgaven. Commerciële AI-diensten vragen in toenemende mate om snellere reactietijden, lagere operationele kosten en een hogere doorvoer over een groeiende gebruikersbasis. Gespecialiseerde processoren kunnen in deze behoeften voorzien wanneer klanten dezelfde modellen herhaaldelijk op grote schaal draaien.
Nvidia deed in december 2025 een vergelijkbare zet door de activa van Groq over te nemen voor $20 miljard, een transactie die het groeiende strategische belang van hoogwaardige inferentietechnologie in de halfgeleidersector onderstreepte. De overname van Taalas door AMD volgt dezelfde trend, maar introduceert een andere modelspecifieke architectuur.
Taalas heeft sinds de oprichting in 2023 in totaal $219 miljoen opgehaald en blijft zijn tweede generatie HC2-processor ontwikkelen, die is ontworpen om modellen van tot wel 20 miljard parameters te ondersteunen.
AMD verwacht dat de transactie wordt afgesloten tijdens het vierde kwartaal van 2026, onder voorbehoud van goedkeuring door de toezichthouders.