Acquisitions
AMD acquiert Taalas pour intégrer des modèles d’IA durcis dans sa feuille de route d’accélérateur

AMD a conclu un accord définitif pour acquérir Taalas, une startup basée à Toronto dont les puces sont conçues sur mesure pour des modèles d’IA individuels, a annoncé le 6 août 2026. L’accord intègre du silicium d’inférence spécialisé dans une gamme d’accélérateurs que AMD a passé l’année dernière à élargir, et il donne au fabricant de puces une équipe d’ingénieurs qui a passé trois ans à attaquer le coût de la mise en service de modèles d’IA plutôt que de les former.
Taalas a été fondée en 2023 et construit ce qu’elle appelle des “Modèles Hardcore” : des processeurs adaptés à un seul modèle, produits en finalisant un petit nombre de couches métalliques d’une puce une fois le modèle fixé. AMD a déclaré que la technologie “optimise les flux de données d’inférence, réduisant considérablement les goulets d’étranglement de calcul et de mémoire associés aux architectures à usage général,” et qu’elle prévoit d’intégrer cette technologie dans sa feuille de route d’accélérateur et de développer des solutions au niveau du système aux côtés des GPU AMD Instinct. La technologie sera aux côtés des systèmes Helios de AMD, des processeurs EPYC et de la pile logicielle ROCm.
“AMD est en train de construire une plate-forme d’IA complète qui donne aux clients la flexibilité de déployer les bonnes solutions de calcul pour chaque charge de travail d’IA,” a déclaré Vamsi Boppana, vice-président senior du groupe Artificial Intelligence chez AMD. “La technologie et l’équipe d’ingénieurs de classe mondiale de Taalas renforcent notre portefeuille d’IA en offrant des performances et une efficacité d’inférence différenciées.”
L’acquisition est soumise aux conditions de clôture et aux approbations réglementaires habituelles.
Ce que Taalas a réellement construit
L’argument de vente de Taalas, présenté dans un article de février 2026 par le co-fondateur et PDG Ljubisa Bajic, est que le matériel d’inférence à usage général comporte une division artificielle : la mémoire d’un côté, le calcul de l’autre. Cette séparation, a écrit Bajic, est ce qui force le conditionnement avancé, les piles de mémoire à large bande, la bande passante d’E/S massive et le refroidissement liquide dans les systèmes d’IA modernes. Taalas fusionne le stockage et le calcul sur une seule puce, et son résultat déclaré est un système sans HBM, sans conditionnement avancé, sans empilement 3D et sans refroidissement liquide.
Le premier produit de l’entreprise, également présenté en février 2026, est une puce durcie avec le modèle Llama 3.1 8B de Meta. Taalas affirme qu’il fonctionne à 17 000 jetons par seconde par utilisateur (presque 10 fois plus rapide que l’état actuel de l’art, selon les données de comparaison de l’entreprise) tout en coûtant 20 fois moins cher à construire et en consommant 10 fois moins de puissance. Ce sont des chiffres de fournisseur, et non des mesures indépendantes, et la première génération de puces les atteint en partie grâce à une quantification agressive à un type de données personnalisé à 3 bits, que Taalas reconnaît dégrade la qualité de sortie par rapport aux références GPU. Sa deuxième génération de silicium passe à des formats de virgule flottante standard à 4 bits.
Le modèle de fabrication est l’autre moitié de l’histoire. Taalas assemble une puce presque complète d’environ 100 couches et effectue la personnalisation finale sur seulement deux couches métalliques, donc Reuters a rapporté en février 2026 que TSMC a besoin d’environ deux mois pour terminer une puce personnalisée pour un modèle particulier, contre environ six mois pour fabriquer un processeur comme Nvidia’s Blackwell. L’article de Bajic indique qu’un modèle jamais vu auparavant peut être réalisé en matériel dans la même fenêtre de deux mois.
Où Taalas s’intègre dans la poussée d’inférence d’AMD
L’accord intervient deux semaines après qu’AMD a utilisé son événement Advancing AI 2026 le 23 juillet 2026 pour lancer sa série de GPU Instinct MI400 et les systèmes Helios, la colonne vertébrale d’une entreprise d’infrastructure qui a signé des engagements de déploiement énormes : jusqu’à 2 gigawatts de GPU Instinct MI450 pour Anthropic, annoncé le 22 juillet 2026, après un accord de 6 gigawatts avec OpenAI en octobre 2025. Ces accords vendent des accélérateurs à usage général par gigawatt. Taalas offre le contraire : une efficacité extrême pour un modèle qui a cessé de changer, au prix de la flexibilité.
AMD a également assemblé la pile d’inférence pièce par pièce — il a annoncé une solution d’inférence à latence ultra-basse avec Cerebras (CBRS ) lors du même événement de juillet — et sa récente série de partenariats et de paris, y compris l’engagement équivalent à 5 milliards de dollars d’Anthropic couvert dans AMD’s $5B Anthropic Bet Tightens AI’s Circular Money Loop, a construit le côté de la demande. La logique d’acquisition reflète ce qu’Anthropic fait de l’autre direction, construisant une équipe de silicium interne pour façonner le matériel autour de ses modèles : à mesure que les volumes d’inférence augmentent, les économies de mise en correspondance du silicium avec la charge de travail commencent à l’emporter sur la commodité d’une seule partie à usage général. Le modèle se propage dans toute l’industrie. Qualcomm (QCOM ) a clôturé son acquisition de la startup de compilateur Modular en juillet 2026, un autre accord construit autour de la spécialisation logiciel-silicium.
Taalas avait levé 219 millions de dollars au total auprès d’investisseurs, notamment Quiet Capital, Fidelity et le capital-risqueur de l’industrie des puces Pierre Lamond, selon Reuters, avec l’article de Bajic notant que le premier produit a été construit par une équipe de 24 personnes avec seulement 30 millions de dollars dépensés. AMD a présenté l’acquisition comme un renforcement de sa présence canadienne de longue date et d’un engagement à conserver et à développer les talents canadiens, un fil qui remonte à son acquisition de l’entreprise de puces de la région de Toronto, ATI, en 2006.
Ce qui se passe ensuite est défini par les conditions de l’accord : l’acquisition doit satisfaire les conditions de clôture et les approbations réglementaires habituelles avant que la technologie de Taalas n’entre formellement dans la feuille de route d’accélérateur d’AMD, et aucune date de clôture n’a été indiquée dans l’annonce.












