Achiziții

AMD cumpără Taalas pentru a integra modele de inteligență artificială hardcodate în acceleratorul său

mm
Adaugă Unite.AI la sursele tale preferate pe Google

AMD a ajuns la un acord definitiv pentru a cumpăra Taalas, o companie startup din Toronto, a cărei cipuri sunt personalizate pentru modele individuale de inteligență artificială, a anunțat pe 6 august 2026. Acordul integrează siliciul de inferență specializat într-o linie de acceleratoare pe care AMD a extins-o în ultimul an și îi oferă producătorului de cipuri o echipă de ingineri care a petrecut trei ani pentru a reduce costul servirii modelelor de inteligență artificială, mai degrabă decât a le antrena.

Taalas a fost fondată în 2023 și construiește ceea ce numește “Modele Hardcore”: procesoare personalizate pentru un singur model, produse prin finalizarea unui număr mic de straturi metalice ale cipului odată ce modelul este fixat. AMD a declarat că tehnologia “optimizează fluxurile de date de inferență, reducând semnificativ blocajele de calcul și de memorie asociate cu arhitecturile cu scop general,” și că intenționează să o integreze în linia de acceleratoare și să dezvolte soluții la nivel de sistem alături de GPU-urile AMD Instinct. Tehnologia va fi plasată lângă sistemele Helios de tip rackscale, procesoarele EPYC și stiva de software ROCm.

“AMD construiește o platformă completă de inteligență artificială care oferă clienților flexibilitatea de a implementa soluții de calcul potrivite pentru fiecare încărcătură de lucru de inteligență artificială,” a declarat Vamsi Boppana, vicepreședinte senior al Grupului de Inteligență Artificială de la AMD. “Tehnologia și echipa de ingineri de clasă mondială a Taalas consolidează portofoliul nostru de inteligență artificială, oferind performanță și eficiență diferențiate de inferență.”

Achiziția este supusă unor condiții și aprobări regulatorii obișnuite.

Ce a construit de fapt Taalas

Pitch-ul lui Taalas, prezentat într-un articol din februarie 2026 de către co-fondatorul și directorul general Ljubisa Bajic, este că hardware-ul de inferență cu scop general are o diviziune artificială: memoria pe o parte, calculul pe cealaltă. Această separare, a scris Bajic, este cea care forțează ambalarea avansată, stivele de memorie cu bandă largă, lățimea de bandă masivă a intrărilor/ieșirilor și răcirea lichidă în sistemele moderne de inteligență artificială. Taalas combină stocarea și calculul pe un singur cip, iar rezultatul declarat este un sistem fără HBM, fără ambalare avansată, fără stivuire 3D și fără răcire lichidă.

Primul produs al companiei, prezentat și el în februarie 2026, este un cip hardcodat cu modelul Llama 3.1 8B al Meta. Taalas afirmă că rulează la 17.000 de tokeni pe secundă pe utilizator (aproape de 10 ori mai rapid decât starea actuală a tehnologiei, conform datelor de comparație ale companiei) și costă de 20 de ori mai puțin pentru a fi construit și consumă de 10 ori mai puțină putere. Acestea sunt numere furnizate de vendor, nu măsurători independente, și partea de primă generație le realizează parțial prin cuantificarea agresivă la un tip de date personalizat de 3 biți, pe care Taalas recunoaște că degradează calitatea ieșirii în comparație cu benchmark-urile GPU. Siliciul de a doua generație trece la formate de punct flotant standard de 4 biți.

Modelul de fabricație este cealaltă jumătate a poveștii. Taalas asamblează un cip aproape complet de aproximativ 100 de straturi și efectuează personalizarea finală pe doar două straturi metalice, așa că Reuters a raportat în februarie 2026 că TSMC are nevoie de aproximativ două luni pentru a finaliza un cip personalizat pentru un anumit model, față de aproximativ șase luni pentru a fabrica un procesor ca Nvidia Blackwell. Postarea lui Bajic spune că un model necunoscut anterior poate fi realizat în hardware în aceeași fereastră de două luni.

Unde se încadrează Taalas în eforturile de inferență ale AMD

Acordul aterizează la două săptămâni după ce AMD a lansat seria de GPU-uri Instinct MI400 și sistemele Helios rackscale la evenimentul Advancing AI 2026 pe 23 iulie 2026, coloana vertebrală a unei afaceri de infrastructură care a semnat angajamente de implementare imense: până la 2 gigawati de GPU-uri Instinct MI450 pentru Anthropic, anunțat pe 22 iulie 2026, după un acord de 6 gigawati cu OpenAI în octombrie 2025. Aceste acorduri vând acceleratoare cu scop general de gigawatt. Taalas oferă schimbul opus: eficiență extremă pentru un model care a încetat să se schimbe, la prețul flexibilității.

AMD a mai adunat și piesele stivei de inferență – a anunțat o soluție de inferență cu latență ultra-scăzută cu Cerebras (CBRS ) la același eveniment din iulie – și seria recentă de parteneriate și investiții, inclusiv angajamentul Anthropic de 5 miliarde de dolari acoperit în pariul de 5 miliarde de dolari al AMD cu Anthropic, a construit partea de cerere. Logica achiziției oglindește ceea ce face Anthropic din direcția opusă, construind o echipă de siliciu internă pentru a modela hardware-ul în jurul modelelor sale: pe măsură ce volumul de inferență crește, economia de a potrivi siliciul cu încărcătura de lucru începe să cântărească mai mult decât conveniența unei părți cu scop general. Modelul se răspândește în întreaga industrie. Qualcomm (QCOM ) a închis achiziția startup-ului de compilatoare Modular în iulie 2026, o altă tranzacție construită în jurul specializării software-siliciu.

Taalas a strâns 219 milioane de dolari în total de la investitori, inclusiv Quiet Capital, Fidelity și capitalistul de venture din industria cipurilor Pierre Lamond, conform Reuters, cu postarea lui Bajic care menționează că primul produs a fost construit de o echipă de 24 de persoane cu doar 30 de milioane de dolari cheltuiți. AMD a prezentat achiziția ca o extindere a prezenței sale de lungă durată în Canada și a angajamentului de a păstra și dezvolta talentele canadiene, un fir care se întinde până la achiziția din 2006 a producătorului de GPU-uri ATI din zona Toronto.

Ce urmează este definit de condițiile acordului: achiziția trebuie să treacă prin condiții și aprobări regulatorii obișnuite înainte ca tehnologia Taalas să intre formal în linia de acceleratoare a AMD, și nu a fost dată nicio dată de închidere în anunț.

Theo Nash este un specialist generat de inteligență artificială la Unite.AI, care acoperă infrastructura de inteligență artificială, calcul și sistemele hardware care alimentează inteligența artificială modernă. Lucrarea sa se concentrează pe fundamentele tehnice ale sarcinilor de lucru cu inteligență artificială la scară largă, incluzând centre de date, acceleratoare, rețele și stivele de software care le leagă împreună.
Cu o perspectivă analitică și inginerice, Theo examinează modul în care progresele în domeniul unităților de procesare grafică, siliciului personalizat, arhitecturilor de memorie și sistemelor distribuite permit noi generații de modele de inteligență artificială. El acordă o atenție deosebită schimburilor de performanță, eficienței energetice, scalabilității și constrângerilor practice care influențează implementarea în lumea reală a infrastructurii de inteligență artificială.
Articolele scrise de Theo Nash sunt generate de inteligență artificială și revizuite de echipa editorială a Unite.AI pentru a asigura acuratețea tehnică, claritatea și o acoperire responsabilă a peisajului de calcul cu inteligență artificială în evoluție rapidă.