Förvärv
AMD köper Taalas för att integrera hårdvarubaserade AI-modeller i sin acceleratorvägkarta

AMD har nått en definitiv överenskommelse om att förvärva Taalas, ett Toronto-baserat startup-företag vars chip är specialbyggda för enskilda AI-modeller, som företaget meddelade den 6 augusti 2026. Affären integrerar specialiserad inferenssilikon i en acceleratorlinje som AMD har tillbringat det senaste året med att expandera, och det ger chip-tillverkaren en ingenjörsteam som har tillbringat tre år med att attackera kostnaden för att serva AI-modeller snarare än att träna dem.
Taalas grundades 2023 och bygger vad de kallar “Hardcore Models”: processorer anpassade för en enskild modells vikter, producerade genom att finalisera ett fåtal av en chips metallager när modellen är fast. AMD sa att tekniken “optimerar inferensdataflöden, vilket signifikant minskar beräknings- och minnesbottleneck som är associerade med allmänna syften-arkitekturer”, och att de planerar att integrera den i sin acceleratorvägkarta och utveckla systemnivå-lösningar tillsammans med AMD Instinct GPUs. Tekniken kommer att sitta bredvid AMD:s Helios rackscale-system, EPYC CPU:er och ROCm-programvarustack.
“AMD bygger en full-stack AI-plattform som ger kunderna flexibiliteten att distribuera rätt beräkningslösningar för varje AI-arbetsbelastning”, sa Vamsi Boppana, senior vice president för Artificial Intelligence Group på AMD. “Taalas teknologi och världsklass-ingenjörsteam stärker vår AI-portfölj genom att leverera differentierad inferensprestanda och effektivitet.”
Förvärvet är föremål för sedvanliga stängningsvillkor och regulatoriska godkännanden.
Vad Taalas faktiskt byggde
Taalas pitch, som presenterades i ett februari 2026-inlägg av medgrundare och VD Ljubisa Bajic, är att allmänna syften-inferensmaskinvara bär på en artificiell skiljevägg: minne på ena sidan, beräkning på den andra. Den skiljeväggen, skrev Bajic, är vad som tvingar avancerad förpackning, höghastighetsminnesstackar, massiv I/O-bandbredd och vätskekylningsmodern AI-system. Taalas slår samman lagring och beräkning på en enda chip, och deras uttalade resultat är ett system med ingen HBM, ingen avancerad förpackning, ingen 3D-stapling och ingen vätskekylnings.
Företagets första produkt, som också presenterades i februari 2026, är en chip som är hårdkodad med Meta:s Llama 3.1 8B-modell. Taalas hävdar att den kör med 17 000 token per sekund per användare (nästan 10 gånger snabbare än den nuvarande tillståndskonsten, enligt företagets egna jämförelsedata) medan den kostar 20 gånger mindre att bygga och förbrukar 10 gånger mindre kraft. Dessa är leverantörsnummer, inte oberoende mätningar, och den första generationens del uppnår dem delvis genom aggressiv kvantisering till en anpassad 3-bitars datatyp, som Taalas medger försämrar utdatakvaliteten i förhållande till GPU-benchmarks. Den andra generationens kisel flyttar till standard 4-bitars flyttalsformat.
Tillverkningsmodellen är den andra halvan av historien. Taalas monterar en nästan komplett chip med cirka 100 lager och utför den slutliga anpassningen på bara två metallager, så Reuters rapporterade i februari 2026 att TSMC behöver cirka två månader för att slutföra en chip som anpassats för en specifik modell, mot cirka sex månader för att tillverka en processor som Nvidias Blackwell. Bajics inlägg säger att en tidigare osynlig modell kan realiseras i hårdvara inom samma tvåmånadersfönster.
Var Taalas passar in i AMD:s inferens-push
Affären landar två veckor efter att AMD använde sin Advancing AI 2026-händelse den 23 juli 2026 för att lansera sin Instinct MI400-seriens GPU:er och Helios rackscale-system, ryggraden i en infrastrukturverksamhet som har undertecknat enorma distributionsåtaganden: upp till 2 gigawatt av Instinct MI450 GPU:er för Anthropic, som meddelades den 22 juli 2026, efter en 6-gigawattavtal med OpenAI i oktober 2025. Dessa avtal säljer allmänna syften-acceleratorer per gigawatt. Taalas erbjuder det motsatta handelsutbytet: extrem effektivitet för en modell som har slutat ändras, till priset av flexibilitet.
AMD har också varit i färd med att montera inferensstacken bit för bit — de meddelade en ultra-låg-latens-inferenslösning med Cerebras (CBRS ) på samma juli-händelse — och deras senaste rad av partnerskap och investeringar, inklusive det aktiebundna Anthropic-åtagandet som täcks i AMD:s 5 miljarder dollar Anthropic-insats tightar AI:s cirkulära pengalopp, har byggt ut efterfrågesidan. Förvärvslogiken speglar vad Anthropic gör från den andra riktningen, bygga ett in-house-silikon-team för att forma hårdvara runt sina modeller: när inferensvolymer växer, börjar ekonomiska fördelarna med att matcha silikon till arbetsbelastning överväga bekvämligheten med en allmän syften-del.
Taalas hade samlat in 219 miljoner dollar i totalt från investerare, inklusive Quiet Capital, Fidelity och chip-industrins riskkapitalist Pierre Lamond, enligt Reuters, med Bajics inlägg som noterar att den första produkten byggdes av ett team på 24 på bara 30 miljoner dollar. AMD framställde förvärvet som en byggnadssten på sin långvariga kanadensiska närvaro och ett åtagande att behålla och växa kanadensisk talang, en tråd som går tillbaka till dess 2006-års köp av Toronto-området GPU-tillverkare ATI.
Vad som händer härnäst definieras av affärens villkor: förvärvet måste klara sedvanliga stängningsvillkor och regulatoriska godkännanden innan Taalas teknologi formellt går in i AMD:s acceleratorvägkarta, och ingen stängningsdatum angavs i meddelandet. Det körs tillbaka till dess 2006-års köp av Toronto-området GPU-tillverkare ATI. Vad som händer härnäst definieras av affärens villkor: förvärvet måste klara sedvanliga stängningsvillkor och regulatoriska godkännanden innan Taalas teknologi formellt går in i AMD:s acceleratorvägkarta, och ingen stängningsdatum angavs i meddelandet.












