Overnames
AMD Koopt Taalas om Hard-Wired AI-Modellen in Zijn Accelerator-Roadmap te Integreren

AMD heeft een definitieve overeenkomst gesloten om Taalas over te nemen, een in Toronto gevestigde startup waarvan de chips speciaal zijn gebouwd voor individuele AI-modellen, zo maakte het bedrijf op 6 augustus 2026 bekend. De overeenkomst voegt gespecialiseerde inferentie-silicium toe aan een accelerator-lijn die AMD het afgelopen jaar heeft uitgebreid, en het geeft de chipmaker een engineersteam dat drie jaar heeft besteed aan het terugdringen van de kosten van het serveren van AI-modellen in plaats van ze te trainen.
Taalas werd in 2023 opgericht en bouwt wat het “Hardcore Models” noemt: processoren die zijn afgestemd op een enkel model, geproduceerd door het finaliseren van een klein aantal metalen lagen van een chip zodra het model is vastgesteld. AMD zei dat de technologie “inference-datastromen optimaliseert, waardoor reken- en geheugengrenzen die verband houden met algemene doelarchitecturen aanzienlijk worden verminderd”, en dat het van plan is om deze te integreren in zijn accelerator-roadmap en systeemniveau-oplossingen te ontwikkelen naast AMD Instinct-GPU’s. De technologie zal naast AMD’s Helios-rackscale-systemen, EPYC-CPU’s en ROCm-software-stack worden geplaatst.
“AMD bouwt een full-stack AI-platform dat klanten de flexibiliteit geeft om de juiste compute-oplossingen voor elke AI-werklast te implementeren”, zei Vamsi Boppana, senior vice-president van de Artificial Intelligence Group bij AMD. “Taalas’ technologie en wereldklasse-engineersteam versterken onze AI-portfolio door gedifferentieerde inferentieprestaties en efficiëntie te bieden.”
De overname is onderworpen aan gebruikelijke sluitingsvoorwaarden en regelgevende goedkeuringen.
Wat Taalas eigenlijk heeft gebouwd
Taalas’ pitch, uiteengezet in een februaripost van 2026 van medeoprichter en CEO Ljubisa Bajic, is dat algemene doel-inferentiehardware een kunstmatige scheiding heeft: geheugen aan de ene kant, rekenen aan de andere kant. Die scheiding, schreef Bajic, is wat geavanceerde verpakking, hoge bandbreedte-geheugens, enorme I/O-bandbreedte en vloeistofkoeling in moderne AI-systemen afdwingt. Taalas combineert opslag en rekenen op één chip, en het resultaat is een systeem met geen HBM, geen geavanceerde verpakking, geen 3D-stacking en geen vloeistofkoeling.
Het eerste product van het bedrijf, eveneens onthuld in februari 2026, is een chip die hard-wired is met Meta’s Llama 3.1 8B-model. Taalas beweert dat het 17.000 tokens per seconde per gebruiker draait (bijna 10 keer sneller dan de huidige stand van de techniek, volgens de vergelijking van het bedrijf) en 20 keer minder kost om te bouwen en 10 keer minder stroom verbruikt. Dit zijn leverancierscijfers, geen onafhankelijke metingen, en het eerste generatie-onderdeel bereikt dit deels door agressieve kwantificatie naar een aangepast 3-bits datatype, wat Taalas toegeeft de outputkwaliteit ten opzichte van GPU-benchmarks degradeert. De tweede generatie silicium gaat over naar standaard 4-bits floating-point format.
Het productiemodel is de andere helft van het verhaal. Taalas assembleert een bijna complete chip van ongeveer 100 lagen en voert de finale aanpassing uit op slechts twee metalen lagen, dus zoals Reuters in februari 2026 rapporteerde heeft TSMC ongeveer twee maanden nodig om een chip te voltooien die is aangepast aan een bepaald model, tegen ongeveer zes maanden om een processor zoals Nvidia’s Blackwell te fabriceren. Bajic’s post zegt dat een eerder ongezien model in twee maanden in hardware kan worden gerealiseerd.
Waar Taalas past in AMD’s inferentie-push
De overeenkomst wordt twee weken na de lancering van AMD’s Instinct MI400 Series GPU’s en Helios-rackscale-systemen op 23 juli 2026 aangekondigd, de ruggengraat van een infrastructuurbedrijf dat enorme implementatieverplichtingen heeft getekend: tot 2 gigawatt aan Instinct MI450 GPU’s voor Anthropic, aangekondigd op 22 juli 2026, na een 6-gigawatt-overeenkomst met OpenAI in oktober 2025. Deze overeenkomsten verkopen algemene doel-accelerators per gigawatt. Taalas biedt het tegenovergestelde: extreme efficiëntie voor een model dat is gestopt met veranderen, tegen de prijs van flexibiliteit.
AMD heeft ook de inferentie-stack stap voor stap opgebouwd — het heeft onlangs een ultra-lage-latentie-inferentie-oplossing met Cerebras (CBRS ) aangekondigd op hetzelfde evenement — en zijn recente reeks partnerships en inzet, waaronder de equity-gekoppelde Anthropic-verplichting die wordt besproken in AMD’s $5B Anthropic Bet Tightens AI’s Circular Money Loop, heeft de vraagzijde opgebouwd. De overname-logica spiegelt wat Anthropic van de andere kant doet door een in-huis siliciumteam op te bouwen om hardware rond zijn modellen te vormen: naarmate de inferentie-volumes groeien, beginnen de economie van het afstemmen van silicium op de workload de gemakkelijkheid van één algemene doel-deel te overtreffen. Het patroon verspreidt zich over de industrie. Qualcomm (QCOM ) heeft zijn overname van compiler-startup Modular in juli 2026 afgerond, een andere overeenkomst die is opgebouwd rond software-naar-silicium-specialisatie.
Taalas had 219 miljoen dollar aan investeringen ontvangen van investeerders, waaronder Quiet Capital, Fidelity en chip-industrie-venture-capitalist Pierre Lamond, volgens Reuters, waarbij Bajic’s post vermeldde dat het eerste product werd gebouwd door een team van 24 met slechts 30 miljoen dollar uitgegeven. AMD heeft de overname geframed als een opbouw van zijn langdurige Canadese aanwezigheid en een toewijding om Canadese talenten te behouden en te laten groeien, een draad die teruggaat tot zijn overname van Toronto-gebied GPU-maker ATI in 2006.
Wat er vervolgens gebeurt, wordt bepaald door de voorwaarden van de overeenkomst: de overname moet de gebruikelijke sluitingsvoorwaarden en regelgevende goedkeuringen doorstaan voordat Taalas’ technologie formeel AMD’s accelerator-roadmap binnenkomt, en er is geen sluitingsdatum gegeven in de aankondiging.












