Akwizycje
AMD kupuje Taalas, aby umieścić w pełni wyposażone modele AI w swojej mapie przyspieszacza

AMD zawarła ostateczną umowę na zakup Taalas, startupu z Toronto, którego układy scalone są dostosowane do poszczególnych modeli AI, jak ogłosiła 6 sierpnia 2026 r. Umowa ta wprowadza specjalistyczny sprzęt do wnioskowania do linii przyspieszaczy, które AMD rozbudowywało przez miniony rok, i daje producentowi układów scalonych zespół inżynierów, którzy przez trzy lata pracowali nad obniżeniem kosztów obsługi modeli AI, a nie ich szkolenia.
Taalas została założona w 2023 r. i buduje to, co nazywa “Hardcore Models”: procesory dostosowane do jednego modelu, wytwarzane przez sfinalizowanie niewielkiej liczby warstw metalowych układu scalonego, gdy model jest ustalony. AMD stwierdziło, że technologia “optymalizuje przepływy danych wnioskowania, znacznie redukując wąskie gardła obliczeniowe i pamięciowe związane z ogólnymi architekturami”, i że planuje ją zintegrować z mapą przyspieszacza i opracować rozwiązania na poziomie systemu wraz z procesorami GPU AMD Instinct. Technologia będzie działać obok systemów AMD Helios, procesorów CPU EPYC i oprogramowania ROCm.
“AMD buduje pełną platformę AI, która daje klientom elastyczność wdrażania odpowiednich rozwiązań obliczeniowych dla każdego obciążenia AI”, powiedział Vamsi Boppana, starszy wiceprezes grupy Artificial Intelligence w AMD. “Technologia Taalas i światowej klasy zespół inżynierów wzmacniają nasz portfel AI, dostarczając wydajność i efektywność wnioskowania.”
Przejęcie podlega zwyczajowym warunkom zamknięcia i zatwierdzeniom regulacyjnym.
Czym tak naprawdę jest Taalas
Pitch Taalas, przedstawiony w poście z lutego 2026 r. przez współzałożyciela i CEO Ljubisę Bajicia, brzmi: ogólnego przeznaczenia sprzętu do wnioskowania niesie ze sobą sztuczne podziały: pamięć po jednej stronie, obliczenia po drugiej. To rozdzielenie, jak napisał Bajic, jest tym, co zmusza zaawansowane opakowania, stosy pamięci o dużej przepustowości, ogromną przepustowość wejścia/wyjścia i chłodzenie cieczą do nowoczesnych systemów AI. Taalas łączy pamięć i obliczenia na jednym układzie scalonym, a deklarowany efekt to system bez HBM, bez zaawansowanego opakowania, bez układów 3D i bez chłodzenia cieczą.
Pierwszy produkt firmy, również przedstawiony w lutym 2026 r., to układ scalony z modelem Meta Llama 3.1 8B. Taalas twierdzi, że działa z prędkością 17 000 tokenów na sekundę na użytkownika (ponad 10 razy szybciej niż obecny stan sztuki, według danych porównawczych firmy) przy koszcie 20 razy niższym i zużyciu mocy 10 razy niższym. Są to dane producenta, a nie niezależne pomiary, a pierwsza generacja osiąga to częściowo dzięki agresywnej kwantyzacji do niestandardowego typu danych 3-bitowych, co Taalas przyznaje, pogarsza jakość wyjścia w porównaniu z benchmarkami GPU. Druga generacja przechodzi na standardowe formaty zmiennoprzecinkowe 4-bitowe.
Model produkcyjny to druga połowa historii. Taalas montuje niemal kompletny układ scalony o około 100 warstwach i wykonuje ostateczną personalizację tylko na dwóch warstwach metalowych, więc Reuters doniósł w lutym 2026 r., że TSMC potrzebuje około dwóch miesięcy, aby dokończyć układ scalony dostosowany do określonego modelu, w porównaniu z około sześcioma miesiącami, aby wytworzyć procesor takiego jak Nvidia Blackwell. Post Bajicia mówi, że wcześniej niewidziany model może być zrealizowany w sprzęcie w tym samym dwumiesięcznym oknie.
Gdzie Taalas pasuje do natarcia AMD w kierunku wnioskowania
Umowa została zawarta dwa tygodnie po tym, jak AMD wykorzystało swoje wydarzenie Advancing AI 2026, które odbyło się 23 lipca 2026 r., do uruchomienia serii GPU Instinct MI400 i systemów Helios, które są podstawą biznesu infrastrukturalnego, który podpisał ogromne zobowiązania wdrożeniowe: do 2 gigawatów procesorów GPU Instinct MI450 dla Anthropic, ogłoszonych 22 lipca 2026 r., po umowie 6-gigawatowej z OpenAI w październiku 2025 r. Te umowy sprzedają ogólnego przeznaczenia przyspieszacze po gigawaty. Taalas oferuje przeciwieństwo: ekstremalną wydajność dla modelu, który przestał się zmieniać, za cenę elastyczności.
AMD również składało stos wnioskowania kawałek po kawałku — ogłosiło ultra-niską latencję rozwiązania wnioskowania z Cerebras (CBRS ) na tym samym lipcowym wydarzeniu — a ostatnia seria partnerstw i zakładów, w tym zobowiązanie Anthropic o wartości 5 miliardów dolarów, opisane w AMD’s $5B Anthropic Bet Tightens AI’s Circular Money Loop, zbudowało popyt. Logika przejęcia jest odbiciem tego, co robi Anthropic z drugiej strony, budując wewnętrzny zespół krzemowy, aby kształtować sprzęt wokół swoich modeli: gdy objętości wnioskowania rosną, ekonomia dopasowania krzemowego do obciążenia zaczyna przeważać nad wygodą jednej ogólnego przeznaczenia części. Wzorzec rozprzestrzenia się w całej branży. Qualcomm (QCOM ) zamknęło przejęcie startupu kompilatora Modular w lipcu 2026 r., kolejną umowę zbudowaną wokół specjalizacji oprogramowania i krzemowego.
Taalas zebrała 219 milionów dolarów od inwestorów, w tym Quiet Capital, Fidelity i chip-industry venture capitalist Pierre Lamond, według Reuters, a post Bajicia mówi, że pierwszy produkt został zbudowany przez zespół 24 osób za tylko 30 milionów dolarów. AMD przedstawiło przejęcie jako kontynuację swojej długiej obecności w Kanadzie i zobowiązanie do utrzymania i rozwoju kanadyjskiego talentu, wątek, który sięga do 2006 r. i zakupu przez AMD producenta GPU z okolic Toronto, ATI.
Co się teraz wydarzy, jest określone przez warunki umowy: przejęcie musi spełnić zwyczajowe warunki zamknięcia i zatwierdzenia regulacyjnego, zanim technologia Taalas formalnie wejdzie do mapy przyspieszacza AMD, a nie podano daty zamknięcia w ogłoszeniu.












