인수합병
AMD, 타알라스 인수… 하드웨어 AI 모델 가속기 로드맵에 통합

AMD는 2026년 8월 6일, 토론토 기반 스타트업인 타알라스를 인수하기로 최종 합의했다고 발표했다. 이 거래는 AMD가 지난 1년 동안 확장해 온 가속기 라인업에 전문적인 추론 실리콘을 통합하는 것이며, AI 모델을 학습하는 것이 아니라 제공하는 비용을 3년 동안 공격적으로 줄여온 엔지니어링 팀을 AMD에게 제공한다.
타알라스는 2023년에 설립되었으며, “하드코어 모델”이라고 불리는 것을 구축한다. 즉, 단일 모델의 가중치를 위해 맞춤형으로 제작된 프로세서를 말한다. 이 프로세서는 모델이 고정된 후에 칩의 금속 層을 최종화하여 제작된다. AMD는 이 기술이 “추론 데이터 흐름을 최적화하여 일반 목적 아키텍처와 관련된 컴퓨팅 및 메모리 병목 현상을 크게 줄인다”고 말했다. 또한 이 기술을 AMD의 가속기 로드맵에 통합하고 AMD Instinct GPU와 함께 시스템 수준의 솔루션을 개발할 계획이라고 말했다. 이 기술은 AMD의 Helios 랙스케일 시스템, EPYC CPU, ROCm 소프트웨어 스택과 함께 작동할 것이다.
“AMD는 고객이 모든 AI 워크로드에 대한 올바른 컴퓨팅 솔루션을 배포할 수 있는 유연성을 제공하는 전체 스택 AI 플랫폼을 구축하고 있다”고 AMD의 인공지능 그룹 선임 부사장인 Vamsi Boppana는 말했다. “타알라스의 기술과 세계 수준의 엔지니어링 팀은 차별화된 추론 성능과 효율성을 제공함으로써 우리의 AI 포트폴리오를 강화한다.”
이 인수는 관습적인 마감 조건과 규제 승인을 받는다는 조건으로 진행된다.
타알라스가 실제로 구축한 것
타알라스의 피치는, 2026년 2월에 공동 설립자이자 CEO인 Ljubisa Bajic이 게시한 글에서, 일반적인 추론 하드웨어가 인공적인 분리를 가지고 있다고 말한다. 즉, 메모리와 컴퓨팅이 분리되어 있다. 이 분리는, Bajic이 작성한 대로, 고대역 메모리 스택, 고대역 입출력 대역폭, 고급 패키징, 3D 스택킹, 액체 냉각 등을 현대의 AI 시스템에 강제한다. 타알라스는 스토리지와 컴퓨팅을 단일 칩에 통합하고, 그 결과는 HBM, 고급 패키징, 3D 스택킹, 액체 냉각이 없는 시스템이라고 말한다.
타알라스의 첫 번째 제품은 2026년 2월에 발표되었으며, 메타의 Llama 3.1 8B 모델을 하드웨어에 직접 구현한 칩이다. 타알라스는 이 칩이 1초당 17,000개의 토큰을 처리할 수 있으며(현재 최고 성능의 10배), 제작 비용은 20배 낮으며, 전력 소모는 10배 낮다고 주장한다. 이는 벤더의 수치이며, 독립적인 측정 결과가 아니다. 첫 번째 세대 칩은 표준 4비트 부동소수점 형식으로 이동하기 전에, 3비트 데이터 형식을 사용하여 공격적으로 양자화한다. 이로 인해 GPU 벤치마크와 비교하여 출력 품질이 저하된다.
제조 모델은 이야기의 다른 半面이다. 타알라스는 거의 완성된 칩을 조립하고, 단지 2개의 금속 層에서 최종 사용자 지정 작업을 수행한다. 따라서, 2026년 2월에 Reuters는 TSMC가 특정 모델을 위한 칩을 완성하는 데 약 2개월이 걸린다고 보도했다. 이는 Nvidia의 Blackwell과 같은 프로세서를 제작하는 데 약 6개월이 걸리는 것과 비교된다. Bajic의 글에서는 이전에 보지 못한 모델이 2개월 이내에 하드웨어로 구현될 수 있다고 말했다.
타알라스가 AMD의 추론 푸시에 어떻게 적합하는지
이 거래는 AMD가 2026년 7월 23일, Instinct MI400 시리즈 GPU와 Helios 랙스케일 시스템을 출시한 Advancing AI 2026 이벤트에서 2주 후에 발생했다. 이 시스템은 AMD가巨額의 배포 약정을 체결한 인프라 비즈니스이다. 예를 들어, 2026년 7월 22일, AMD는 Anthropic과 Instinct MI450 시리즈 GPU를 최대 2ギガ와트까지 배포하는 전략적 파트너십을 발표했다. 이는 2025년 10월에 OpenAI와 체결한 6ギガ와트 협약에 따른 것이다. 이러한 거래는 일반적인 목적의 가속기를 기가와트 단위로 판매한다. 타알라스는 반대되는 거래를 제공한다. 즉, 모델이 더 이상 변경되지 않는 경우에 극단적인 효율성을 제공하지만, 유연성을 희생한다.
AMD는 또한 추론 스택을 조각조각 구축해 왔다. 예를 들어, 7월의 같은 이벤트에서, AMD는 Cerebras와 초저지연 추론 솔루션을 발표했다. 또한, 최근의 파트너십과 투자, 예를 들어 Anthropic과의 50억 달러의 투자, 는 수요 측면을 구축했다. 이 인수 논리는 Anthropic이 모델 주변의 硬件를 구축하는 것과 반대 방향으로 진행된다. 즉, 추론 볼륨이 증가함에 따라, 일종의 硬件를 작업량에 맞추는 경제성이 일반적인 硬件의 편리성을超过한다. 이 패턴은 산업 전반에 퍼지고 있다. 예를 들어, Qualcomm은 2026년 7월에 컴파일러 스타트업 Modular을 인수했다. 이는 소프트웨어에서 硬件으로의 전문화를 위한 또 다른 거래이다.
타알라스는 Quiet Capital, Fidelity, Pierre Lamond를 포함한 투자자로부터 총 2억 1,900만 달러를 투자받았다. Bajic의 글에서는 첫 번째 제품이 24명의 팀이 3,000만 달러를 투자하여 제작했다고 말했다. AMD는 이 인수를 캐나다 현지 인재를 유지하고 성장시키는 데 대한 의지와 캐나다에 대한 오랜 존재를 강화하는 것으로 보았다. 이는 2006년 AMD가 토론토 지역의 GPU 제조업체인 ATI를 인수한 이후부터 이어진 것이다.
이 거래의 다음 단계는 거래 조건에 의해 정의된다. 즉, 인수가 관습적인 마감 조건과 규제 승인을 통과해야 하며, 타알라스의 기술이 공식적으로 AMD의 가속기 로드맵에 통합되기 전에, 마감 날짜는 발표에서 지정되지 않았다.












