인수합병

AMD, 타알라스 인수… 하드웨어 AI 모델 가속기 로드맵에 통합

mm
Unite.AI를 Google의 선호 소스에 추가

AMD는 2026년 8월 6일, 토론토 기반 스타트업인 타알라스를 인수하기로 최종 합의했다고 발표했다. 이 거래는 AMD가 지난 1년 동안 확장해 온 가속기 라인업에 전문적인 추론 실리콘을 통합하는 것이며, AI 모델을 학습하는 것이 아니라 제공하는 비용을 3년 동안 공격적으로 줄여온 엔지니어링 팀을 AMD에게 제공한다.

2023년 설립된 Taalas는 “Hardcore Models”라는 기술을 만든다. 모델이 확정된 뒤 칩의 일부 금속층을 마무리해 특정 모델의 가중치에 맞춘 프로세서를 제작하는 방식이다. AMD는 이 기술이 추론 데이터 흐름을 최적화해 범용 아키텍처의 연산·메모리 병목을 크게 줄인다고 설명했다. 이를 가속기 로드맵에 통합하고 Instinct GPU와 함께 시스템 수준의 솔루션을 개발할 계획이다. 기술은 Helios 랙 규모 시스템, EPYC CPU, ROCm 소프트웨어와 함께 사용될 예정이다.

“AMD는 고객이 모든 AI 워크로드에 대한 올바른 컴퓨팅 솔루션을 배포할 수 있는 유연성을 제공하는 전체 스택 AI 플랫폼을 구축하고 있다”고 AMD의 인공지능 그룹 선임 부사장인 Vamsi Boppana는 말했다. “타알라스의 기술과 세계 수준의 엔지니어링 팀은 차별화된 추론 성능과 효율성을 제공함으로써 우리의 AI 포트폴리오를 강화한다.”

이 인수는 관습적인 마감 조건과 규제 승인을 받는다는 조건으로 진행된다.

타알라스가 실제로 구축한 것

타알라스의 피치는, 2026년 2월에 공동 설립자이자 CEO인 Ljubisa Bajic이 게시한 글에서, 일반적인 추론 하드웨어가 인공적인 분리를 가지고 있다고 말한다. 즉, 메모리와 컴퓨팅이 분리되어 있다. 이 분리는, Bajic이 작성한 대로, 고대역 메모리 스택, 고대역 입출력 대역폭, 고급 패키징, 3D 스택킹, 액체 냉각 등을 현대의 AI 시스템에 강제한다. 타알라스는 스토리지와 컴퓨팅을 단일 칩에 통합하고, 그 결과는 HBM, 고급 패키징, 3D 스택킹, 액체 냉각이 없는 시스템이라고 말한다.

타알라스의 첫 번째 제품은 2026년 2월에 발표되었으며, 메타의 Llama 3.1 8B 모델을 하드웨어에 직접 구현한 칩이다. 타알라스는 이 칩이 1초당 17,000개의 토큰을 처리할 수 있으며(현재 최고 성능의 10배), 제작 비용은 20배 낮으며, 전력 소모는 10배 낮다고 주장한다. 이는 벤더의 수치이며, 독립적인 측정 결과가 아니다. 첫 번째 세대 칩은 표준 4비트 부동소수점 형식으로 이동하기 전에, 3비트 데이터 형식을 사용하여 공격적으로 양자화한다. 이로 인해 GPU 벤치마크와 비교하여 출력 품질이 저하된다.

제조 방식도 핵심이다. Taalas는 약 100개 층으로 이뤄진 거의 완성된 칩을 만들고 금속층 두 개만 최종 맞춤 처리한다. 로이터의 2026년 2월 보도에 따르면 TSMC는 특정 모델용 칩을 완성하는 데 약 두 달이 걸린다. 엔비디아 Blackwell 같은 프로세서 제작에 약 여섯 달이 걸리는 것과 대비된다. 바이치의 글은 이전에 없던 모델도 같은 두 달 안에 하드웨어로 구현할 수 있다고 설명한다.

타알라스가 AMD의 추론 푸시에 어떻게 적합하는지

이번 계약은 AMD가 2026년 7월 23일 Advancing AI 행사에서 Instinct MI400 GPU와 Helios 랙 규모 시스템을 공개한 지 2주 뒤 나왔다. AMD는 이 인프라 사업에서 대규모 배포 약정을 맺어 왔다. 2025년 10월 오픈AI와 6GW 계약을 체결한 데 이어 2026년 7월 22일에는 앤트로픽에 Instinct MI450 GPU를 최대 2GW 배포하는 협력을 발표했다. 이런 계약은 범용 가속기를 GW 단위로 공급한다. Taalas는 유연성을 내주는 대신 더 이상 바뀌지 않는 모델에서 극도의 효율을 얻는 다른 선택지를 제공한다.

AMD는 추론 시스템을 구성요소별로 갖추고 있다. 같은 7월 행사에서 Cerebras (CBRS )와 초저지연 추론 솔루션을 발표했고, 지분과 연계된 50억 달러 규모의 앤트로픽 약정을 포함한 최근 협력과 투자는 수요 측면을 넓혔다. 이는 앤트로픽이 자체 반도체팀을 만들어 모델에 맞는 하드웨어를 설계하려는 것과 다른 방향에서 같은 논리를 따른다. 추론량이 커질수록 작업에 맞춘 반도체의 경제성이 범용 부품 하나를 쓰는 편의성보다 중요해진다. 업계 전반에서도 이런 흐름이 나타난다. Qualcomm (QCOM )은 2026년 7월 컴파일러 스타트업 Modular 인수를 마쳤다. 소프트웨어와 반도체의 특화에 초점을 맞춘 또 다른 거래다.

타알라스는 Quiet Capital, Fidelity, Pierre Lamond를 포함한 투자자로부터 총 2억 1,900만 달러를 투자받았다. Bajic의 글에서는 첫 번째 제품이 24명의 팀이 3,000만 달러를 투자하여 제작했다고 말했다. AMD는 이 인수를 캐나다 현지 인재를 유지하고 성장시키는 데 대한 의지와 캐나다에 대한 오랜 존재를 강화하는 것으로 보았다. 이는 2006년 AMD가 토론토 지역의 GPU 제조업체인 ATI를 인수한 이후부터 이어진 것이다.

이 거래의 다음 단계는 거래 조건에 의해 정의된다. 즉, 인수가 관습적인 마감 조건과 규제 승인을 통과해야 하며, 타알라스의 기술이 공식적으로 AMD의 가속기 로드맵에 통합되기 전에, 마감 날짜는 발표에서 지정되지 않았다.

원문 기사의 출처: newsroom.amd.com [1] · taalas.com [2] · reuters.com [3] · newsroom.amd.com [4] · ir.amd.com [5] · ir.amd.com [6] · unite.ai [7] · unite.ai [8] · unite.ai [9]

테오 내쉬유나이트.AI의 AI 생성 전문가로, AI 인프라, 컴퓨팅, 및 현대적인 인공 지능을 구동하는 하드웨어 시스템을 다룹니다. 그의 작업은 대규모 AI 워크로드를 위한 기술적 기초에 중점을 두고 있으며, 데이터 센터, 가속기, 네트워킹, 및 이를 연결하는 소프트웨어 스택을 포함합니다.
분석적이고 엔지니어링 중심의 관점에서 테오 내쉬는 GPU, 커스텀 실리콘, 메모리 아키텍처, 및 분산 시스템의 발전에 따라 새로운 세대의 AI 모델이 어떻게 가능해지는지 조사합니다. 그는 성능 트레이드오프, 에너지 효율성, 확장성, 및 실제로 AI 인프라를 배치하는 실질적인 제약에 특별한 주의를 기울입니다.
테오 내쉬가 작성한 기사들은 AI로 생성되어 유나이트.AI의 편집 팀에 의해 검토되어 기술적 정확성, 명확성, 및 급변하는 AI 컴퓨팅 환경에 대한 책임 있는 보도를 보장합니다.