Aquisições

A AMD Compra a Taalas para Inserir Modelos de IA em Seu Roadmap de Aceleradores

mm
Adicione Unite.AI às suas fontes preferidas no Google

A AMD chegou a um acordo definitivo para adquirir a Taalas, uma startup de Toronto cujos chips são personalizados para modelos de IA individuais, a empresa anunciou em 6 de agosto de 2026. O acordo incorpora silício de inferência especializado em uma linha de aceleradores que a AMD tem expandido ao longo do último ano, e fornece à fabricante de chips uma equipe de engenharia que passou três anos atacando o custo de servir modelos de IA em vez de treiná-los.

A Taalas foi fundada em 2023 e constrói o que chama de “Modelos Hardcore”: processadores personalizados para um modelo específico, produzidos finalizando um número pequeno de camadas metálicas do chip uma vez que o modelo é fixado. A AMD disse que a tecnologia “otimiza fluxos de dados de inferência, reduzindo significativamente gargalos de computação e memória associados a arquiteturas de propósito geral”, e que planeja integrá-la em seu roadmap de aceleradores e desenvolver soluções de nível de sistema ao lado dos GPUs AMD Instinct. A tecnologia será colocada ao lado dos sistemas de escala de rack Helios da AMD, CPUs EPYC e pilha de software ROCm.

“A AMD está construindo uma plataforma de IA completa que dá aos clientes a flexibilidade de implantar as soluções de computação certas para cada carga de trabalho de IA”, disse Vamsi Boppana, vice-presidente sênior do Grupo de Inteligência Artificial da AMD. “A tecnologia e a equipe de engenharia de classe mundial da Taalas fortalecem nosso portfólio de IA, entregando desempenho e eficiência de inferência diferenciados.”

A aquisição está sujeita a condições de fechamento e aprovações regulatórias habituais.

O que a Taalas realmente construiu

O discurso da Taalas, apresentado em uma postagem de fevereiro de 2026 pelo co-fundador e CEO Ljubisa Bajic, é que o hardware de inferência de propósito geral carrega uma divisão artificial: memória de um lado, computação do outro. Essa separação, escreveu Bajic, é o que força o empacotamento avançado, pilhas de memória de banda larga, largura de banda de E/S maciça e resfriamento líquido em sistemas de IA modernos. A Taalas combina armazenamento e computação em um único chip, e o resultado declarado é um sistema com nenhum HBM, nenhum empacotamento avançado, nenhuma pilha 3D e nenhum resfriamento líquido.

O primeiro produto da empresa, também lançado em fevereiro de 2026, é um chip com fio cruzado com o modelo Llama 3.1 8B da Meta. A Taalas afirma que ele roda a 17.000 tokens por segundo por usuário (quase 10 vezes mais rápido do que o estado da arte atual, de acordo com os dados de comparação da própria empresa) enquanto custa 20 vezes menos para construir e consome 10 vezes menos energia. Esses são números de fornecedor, não medições independentes, e a parte de primeira geração alcança isso em parte por meio de quantização agressiva para um tipo de dados personalizado de 3 bits, que a Taalas admite degrada a qualidade de saída em relação aos benchmarks de GPU. Seu silício de segunda geração passa para formatos de ponto flutuante de 4 bits padrão.

O modelo de fabricação é a outra metade da história. A Taalas monta um chip quase completo de cerca de 100 camadas e realiza a personalização final em apenas duas camadas metálicas, então a Reuters relatou em fevereiro de 2026 que a TSMC precisa de cerca de dois meses para terminar um chip personalizado para um modelo específico, contra cerca de seis meses para fabricar um processador como o Blackwell da Nvidia. A postagem de Bajic diz que um modelo nunca visto antes pode ser realizado em hardware na mesma janela de dois meses.

Onde a Taalas se encaixa na ofensiva de inferência da AMD

O acordo chega duas semanas após a AMD usar seu evento Advancing AI 2026 em 23 de julho de 2026 para lançar sua série de GPUs Instinct MI400 e sistemas de escala de rack Helios, a espinha dorsal de um negócio de infraestrutura que tem assinado compromissos de implantação enormes: até 2 gigawatts de GPUs Instinct MI450 para a Anthropic, anunciado em 22 de julho de 2026, após um acordo de 6 gigawatts com a OpenAI em outubro de 2025. Esses acordos vendem aceleradores de propósito geral por gigawatt. A Taalas oferece o oposto: eficiência extrema para um modelo que parou de mudar, ao preço da flexibilidade.

A AMD também tem reunido a pilha de inferência peça por peça — ela anunciou uma solução de inferência de baixa latência com a Cerebras (CBRS ) no mesmo evento de julho — e sua recente série de parcerias e apostas, incluindo o compromisso de Anthropic com participação acionária coberto em Aposta de US$ 5 bilhões da AMD na Anthropic, construiu o lado da demanda. A lógica da aquisição espelha o que a Anthropic está fazendo do outro lado, construindo uma equipe de silício interna para moldar o hardware em torno de seus modelos: à medida que os volumes de inferência crescem, a economia de combinar silício com carga de trabalho começa a superar a conveniência de uma parte de propósito geral. O padrão está se espalhando por toda a indústria. A Qualcomm (QCOM ) fechou sua aquisição da startup de compilador Modular em julho de 2026, outro acordo construído em torno da especialização de software para silício.

A Taalas havia levantado US$ 219 milhões no total de investidores, incluindo Quiet Capital, Fidelity e o venture capitalist da indústria de chips Pierre Lamond, de acordo com a Reuters, com a postagem de Bajic observando que o primeiro produto foi construído por uma equipe de 24 pessoas com apenas US$ 30 milhões gastos. A AMD enquadrava a aquisição como uma construção em sua presença canadense de longa data e um compromisso de reter e crescer talentos canadenses, uma linha que remonta à sua compra de 2006 da fabricante de GPUs da área de Toronto, a ATI.

O que acontece em seguida é definido pelas condições do acordo: a aquisição deve atender às condições de fechamento e aprovações regulatórias habituais antes que a tecnologia da Taalas entre formalmente no roadmap de aceleradores da AMD, e nenhuma data de fechamento foi dada no anúncio.

A aquisição ocorre em um momento em que a AMD está expandindo sua presença no mercado de IA, e a tecnologia da Taalas pode desempenhar um papel importante nessa estratégia. A AMD tem sido uma das principais empresas de tecnologia a investir em IA, e a aquisição da Taalas é mais um passo nessa direção.

Theo Nash é um especialista em AI gerado pela Unite.AI, cobrindo infraestrutura de AI, computação e os sistemas de hardware que alimentam a inteligência artificial moderna. Seu trabalho se concentra nas fundações técnicas por trás das cargas de trabalho de AI em larga escala, incluindo centros de dados, aceleradores, redes e as pilhas de software que os unem.
Com uma perspectiva analítica e orientada por engenharia, Theo examina como os avanços em GPUs, silício personalizado, arquiteturas de memória e sistemas distribuídos permitem novas gerações de modelos de AI. Ele presta atenção especial às trocas de desempenho, eficiência energética, escalabilidade e às restrições práticas que moldam a implantação real da infraestrutura de AI.
Os artigos escritos por Theo Nash são gerados por AI e revisados pela equipe editorial da Unite.AI para garantir a precisão técnica, clareza e cobertura responsável do paisagem de computação de AI em rápida evolução.