AMD compra a Taalas, startup que grava modelos de IA diretamente no silício
Em 6/8, a AMD acertou a compra da canadense Taalas, que fabrica chips de inferência feitos sob medida para um único modelo de IA. Valor não foi revelado.
A AMD anunciou em 6 de agosto de 2026 um acordo definitivo para comprar a Taalas, startup de Toronto, no Canadá, que desenvolve chips de inferência de inteligência artificial projetados em torno de um modelo específico. O valor não foi divulgado, e o negócio ainda depende de condições habituais de fechamento e de aprovações regulatórias. Segundo o comunicado da AMD, a tecnologia será integrada ao roteiro de aceleradores da empresa e combinada às GPUs Instinct em soluções de sistema.
Como funciona a ideia da Taalas
Fundada em 2023, a Taalas parte de uma premissa oposta à das GPUs. Em vez de um processador programável que carrega pesos de qualquer modelo a partir da memória, ela grava os pesos e o fluxo de dados de um modelo já treinado diretamente nos transistores. Isso elimina boa parte do vaivém de dados entre memória de alta largura de banda (HBM) e unidades de cálculo, um dos principais gargalos da inferência.
O primeiro chip de demonstração, o HC1, é fabricado no processo de 6 nanômetros da TSMC, tem 815 mm² e 53 bilhões de transistores e roda o Llama 3.1 8B, da Meta. A Taalas afirma que ele entrega cerca de 17 mil tokens por segundo por usuário e, em fevereiro, disse que isso equivalia a 73 vezes o desempenho de uma Nvidia H200 com um décimo da energia, como registrou o SiliconANGLE. Esses números vêm da própria empresa e não foram verificados de forma independente nas fontes consultadas. Um segundo chip, o HC2, mira modelos de cerca de 20 bilhões de parâmetros.
A troca: velocidade por flexibilidade
O custo da abordagem é que o chip roda apenas o modelo para o qual foi feito; um modelo novo exige silício novo. A Taalas diz que isso é mais barato do que parece, porque só duas das mais de cem camadas do chip mudam de um projeto para outro, e estima em cerca de dois meses o tempo para transformar um modelo em chip. A Jon Peddie Research observa ainda que a primeira geração usa quantização agressiva, de 3 e 6 bits, que a própria empresa reconhece degradar a qualidade em relação a GPUs. A segunda geração passa a formatos padronizados de ponto flutuante de 4 bits.
Para a consultoria, a compra faz mais sentido como complemento do que como concorrente das GPUs Instinct. A AMD poderia manter o hardware programável para cargas que mudam e usar silício dedicado onde um modelo, ou parte dele, for estável e usado em volume suficiente para compensar a especialização.
Contexto: a disputa pela inferência
A inferência, etapa em que modelos já treinados respondem a usuários e agentes, é descrita pela AMD como um dos segmentos que mais crescem no mercado de IA, e grandes fabricantes buscam alternativas às GPUs de uso geral. O SiliconANGLE lembra que a Nvidia fechou em dezembro um acordo de licenciamento de tecnologia de inferência com a Groq. Segundo o site, a Taalas é a terceira aquisição de IA da AMD em nove meses, depois da MK1 e da Mext. A startup havia captado US$ 169 milhões em fevereiro, somando cerca de US$ 219 milhões.
“Fundamos a Taalas para repensar a inferência de IA desde a base, construindo o hardware em torno do modelo”, disse o cofundador e CEO Ljubisa Bajic, que antes comandou a Tenstorrent. Vamsi Boppana, vice-presidente sênior do grupo de IA da AMD, afirmou que a tecnologia e a equipe da startup fortalecem o portfólio com desempenho e eficiência diferenciados em inferência. Até a data desta edição, a AMD não havia anunciado a conclusão da compra nem produtos com a tecnologia.
Fontes
- AMD (Relações com Investidores) — AMD Acquires Taalas to Advance Compute Solutions for Rapidly Growing AI Inference Market (06/08/2026)
- SiliconANGLE — AMD acquires Taalas to hardwire AI models into silicon (06/08/2026)
- Jon Peddie Research — AMD buys Taalas and a very different idea about AI inference (10/08/2026)
Imagem destacada: ilustração gerada por computador, sem valor documental.


