Akuisisi

AMD Membeli Taalas untuk Memasang Model AI yang Dikeraskan ke Dalam Roadmap Akselerator

mm
Tambahkan Unite.AI ke sumber pilihan Anda di Google

AMD telah mencapai kesepakatan definitif untuk membeli Taalas, sebuah startup yang berbasis di Toronto yang chip-nya dibangun khusus untuk model AI individual, perusahaan mengumumkan pada 6 Agustus 2026. Kesepakatan ini memasukkan silikon inferensi khusus ke dalam lini akselerator yang telah dibangun AMD selama setahun terakhir, dan memberikan pembuat chip tim insinyur yang telah menghabiskan tiga tahun untuk menyerang biaya penyajian model AI daripada melatihnya.

Taalas didirikan pada 2023 dan membangun apa yang mereka sebut “Model Hardcore”: prosesor yang disesuaikan dengan model tunggal, diproduksi dengan menyelesaikan sejumlah kecil lapisan logam chip sekali model telah ditetapkan. AMD mengatakan teknologi “mengoptimalkan aliran data inferensi, mengurangi bottleneck komputasi dan memori yang terkait dengan arsitektur umum,” dan bahwa mereka berencana untuk mengintegrasikannya ke dalam roadmap akselerator dan mengembangkan solusi sistemik bersama dengan GPU AMD Instinct. Teknologi ini akan ditempatkan di samping sistem rackscale Helios, CPU EPYC, dan tumpukan perangkat lunak ROCm AMD.

“AMD sedang membangun platform AI penuh yang memberikan fleksibilitas kepada pelanggan untuk mengirimkan solusi komputasi yang tepat untuk setiap beban kerja AI,” kata Vamsi Boppana, wakil presiden senior Kelompok Kecerdasan Buatan di AMD. “Teknologi Taalas dan tim insinyur kelas dunia memperkuat portofolio AI kami dengan memberikan kinerja inferensi dan efisiensi yang berbeda.”

Akuisisi ini tunduk pada kondisi penutupan dan persetujuan regulasi yang biasa.

Apa yang Sebenarnya Dibangun Taalas

Presentasi Taalas, yang diuraikan dalam pos pada Februari 2026 oleh co-pendiri dan CEO Ljubisa Bajic, adalah bahwa perangkat keras inferensi umum membawa pemisahan buatan: memori di satu sisi, komputasi di sisi lain. Pemisahan itu, Bajic menulis, adalah yang memaksa pengemasan lanjutan, tumpukan memori bandwidth tinggi, bandwidth I/O besar, dan pendinginan cair ke dalam sistem AI modern. Taalas menggabungkan penyimpanan dan komputasi pada chip tunggal, dan hasilnya adalah sistem dengan tidak ada HBM, tidak ada pengemasan lanjutan, tidak ada tumpukan 3D, dan tidak ada pendinginan cair.

Produk pertama perusahaan, juga diluncurkan pada Februari 2026, adalah chip yang dikeraskan dengan model Llama 3.1 8B Meta. Taalas mengklaim bahwa itu berjalan pada 17.000 token per detik per pengguna (hampir 10 kali lebih cepat dari keadaan seni saat ini, menurut data perbandingan perusahaan) sambil menghabiskan biaya 20 kali lebih rendah untuk dibangun dan mengonsumsi 10 kali lebih sedikit daya. Ini adalah angka vendor, bukan pengukuran independen, dan bagian pertama generasi ini mencapai ini sebagian melalui kuantisasi agresif ke tipe data 3-bit khusus, yang Taalas akui merusak kualitas output relatif terhadap benchmark GPU. Silikon generasi keduanya beralih ke format titik mengambang 4-bit standar.

Model manufaktur adalah setengah lain dari cerita. Taalas merakit chip hampir lengkap sekitar 100 lapis dan melakukan kustomisasi akhir pada hanya dua lapisan logam, sehingga Reuters melaporkan pada Februari 2026 bahwa TSMC membutuhkan sekitar dua bulan untuk menyelesaikan chip yang dikustomisasi untuk model tertentu, dibandingkan dengan sekitar enam bulan untuk memfabrikasi prosesor seperti Nvidia Blackwell. Posting Bajic mengatakan bahwa model yang belum pernah terlihat sebelumnya dapat direalisasikan dalam perangkat keras dalam jendela dua bulan yang sama.

Di Mana Taalas Berada di Dorongan Inferensi AMD

Kesepakatan ini mendarat dua minggu setelah AMD menggunakan acara Advancing AI 2026 pada 23 Juli 2026 untuk meluncurkan seri GPU Instinct MI400 dan sistem rackscale Helios, tulang punggung bisnis infrastruktur yang telah menandatangani komitmen penerapan besar: hingga 2 gigawatt GPU Instinct MI450 untuk Anthropic, diumumkan pada 22 Juli 2026, setelah perjanjian 6-gigawatt dengan OpenAI pada Oktober 2025. Kesepakatan-kesepakatan ini menjual akselerator umum dengan gigawatt. Taalas menawarkan perdagangan yang berlawanan: efisiensi ekstrem untuk model yang telah berhenti berubah, dengan harga fleksibilitas.

AMD juga telah merakit tumpukan inferensi bagian demi bagian — mereka mengumumkan solusi inferensi ultra-rendah-latensi dengan Cerebras (CBRS ) pada acara yang sama — dan serangkaian kemitraan dan taruhan baru-baru ini, termasuk komitmen Anthropic yang terkait ekuitas yang diliput dalam Taruhan $5 Miliar AMD pada Anthropic Mengencangkan Lingkaran Uang AI, telah membangun sisi permintaan. Logika akuisisi ini mencerminkan apa yang dilakukan Anthropic dari arah lain, membangun tim silikon internal untuk membentuk perangkat keras di sekitar modelnya: ketika volume inferensi tumbuh, ekonomi pencocokan silikon dengan beban kerja mulai mengungguli kenyamanan satu bagian umum. Pola ini menyebar di seluruh industri. Qualcomm (QCOM ) menutup akuisisi compiler startup Modular pada Juli 2026, kesepakatan lain yang dibangun di sekitar spesialisasi perangkat lunak-ke-silikon.

Taalas telah mengumpulkan $219 juta dari investor termasuk Quiet Capital, Fidelity, dan ventura chip-industri Pierre Lamond, menurut Reuters, dengan posting Bajic yang mencatat produk pertama dibangun oleh tim 24 orang dengan hanya $30 juta yang dihabiskan. AMD menggambarkan akuisisi sebagai membangun pada kehadiran Kanada yang mapan dan komitmen untuk mempertahankan dan meningkatkan bakat Kanada, benang yang berjalan kembali ke pembelian 2006 dari pembuat GPU daerah Toronto ATI.

Apa yang terjadi selanjutnya didefinisikan oleh kondisi kesepakatan: akuisisi harus memenuhi kondisi penutupan dan persetujuan regulasi yang biasa sebelum teknologi Taalas secara resmi memasuki roadmap akselerator AMD, dan tidak ada tanggal penutupan yang diberikan dalam pengumuman.

Theo Nash adalah seorang spesialis yang dihasilkan oleh AI di Unite.AI, yang meliputi infrastruktur AI, komputasi, dan sistem perangkat keras yang memungkinkan kecerdasan buatan modern. Pekerjaannya berfokus pada fondasi teknis di balik beban kerja AI skala besar, termasuk pusat data, akselerator, jaringan, dan tumpukan perangkat lunak yang menghubungkannya.
Dengan perspektif analitis dan berbasis teknik, Theo memeriksa bagaimana kemajuan dalam GPU, silikon kustom, arsitektur memori, dan sistem terdistribusi memungkinkan generasi baru model AI. Ia memperhatikan khusus pada pertukaran kinerja, efisiensi energi, skalabilitas, dan kendala praktis yang membentuk penerapan infrastruktur AI di dunia nyata.
Artikel yang ditulis oleh Theo Nash dihasilkan oleh AI dan ditinjau oleh tim editorial Unite.AI untuk memastikan akurasi teknis, kejelasan, dan liputan yang bertanggung jawab atas lanskap komputasi AI yang berkembang pesat.