AMD lança o rack Helios com 72 GPUs MI455X e diz que ele já está em produção plena
Lançado em 23/7, o Helios reúne 72 GPUs MI455X e 31 TB de HBM4 por rack; AMD prevê entregas a partir do fim do 3º trimestre e cita OpenAI e Meta.
A AMD lançou em 23 de julho de 2026, durante o evento Advancing AI 2026, em São Francisco, o Helios, sistema de IA em escala de rack que reúne 72 GPUs Instinct MI455X, processadores EPYC de sexta geração, conhecidos como Venice, rede Pensando e o software ROCm. Segundo cobertura do Converge Digest, a empresa informou que o Helios já está em produção plena, com primeiras entregas previstas para o fim do terceiro trimestre e aceleração no quarto. Segundo a publicação, o Helios marca a passagem da AMD do fornecimento de processadores avulsos para o projeto do rack completo como sistema integrado.
O que há dentro do rack
De acordo com a AMD, um único rack oferece até 2,9 exaflops de desempenho de pico em FP4 e 1,4 exaflop em FP8, 31 TB de memória HBM4 e 1,7 petabyte por segundo de largura de banda de memória. São 18 bandejas de computação com quatro GPUs cada. A interconexão interna usa UALink sobre Ethernet (UALoE), e a conexão entre racks segue o padrão Ethernet alinhado ao Ultra Ethernet Consortium, com placas Pensando Vulcano de 800 Gb/s. O Converge Digest detalha 260 TB/s de banda de interconexão interna e 43 TB/s entre racks. Cada MI455X tem 320 bilhões de transistores, 432 GB de HBM4 e até 19,6 TB/s de largura de banda, com chiplets fabricados nos processos de 2 nm e 3 nm da TSMC.
As comparações da AMD
No comunicado, a AMD afirma que o Helios supera a principal solução concorrente em 15% no desempenho de pico em FP4, 50% em capacidade de HBM, 6% em largura de banda de memória e 50% em banda entre racks, e que entrega até 30% mais tokens por dólar. No blog de lançamento, a empresa identifica a referência como o rack Vera Rubin NVL72, da Nvidia. As notas de rodapé indicam que os números são projeções e modelagens, com medições em hardware de pré-produção ou de referência; não há teste independente publicado. O Tom’s Hardware, em reportagem de 20 de julho, observou que o desempenho do UALink sobre Ethernet na prática ainda precisa ser comprovado.
Quem vai usar
Segundo o Converge Digest, a AMD apresentou no palco compromissos de clientes. A OpenAI tem acordo de até 6 gigawatts em GPUs da AMD, começando com uma implantação de MI450 no segundo semestre de 2026, e a Meta tem acordo separado do mesmo porte. A Anthropic planeja usar até 2 gigawatts de capacidade Helios, com o primeiro gigawatt a partir do primeiro semestre de 2027, enquanto a AMD se comprometeu a investir até US$ 5 bilhões na empresa. Dias antes, conforme o Tom’s Hardware, a Microsoft anunciou que vai implantar o Helios em escala no Azure, sem revelar o tamanho do contrato.
A AMD também apresentou uma colaboração com a Cerebras, na qual o Helios processa a etapa inicial dos prompts e o chip em escala de wafer da Cerebras cuida da geração de tokens. A estimativa conjunta de até cinco vezes mais tokens por segundo por watt é uma modelagem das empresas.
Contexto
A presidente do conselho e CEO da AMD, Lisa Su, justificou a aposta com a mudança no uso de computação: segundo a empresa, cerca de 60% da capacidade global de IA em 2026 deve ir para inferência, e não para treinamento. Na avaliação do Converge Digest, o Helios coloca a AMD em disputa direta com outras plataformas integradas de rack, em que maturidade de software, confiabilidade de implantação e desempenho com milhares de aceleradores interligados pesam tanto quanto a ficha técnica de cada chip.
Fontes
- AMD Newsroom — AAI 2026: AMD Launches AMD Helios Rackscale Solution for Frontier AI (23/07/2026)
- AMD (blog) — AMD Launches Helios, the Highest-Performing Rackscale AI Infrastructure Solution (23/07/2026)
- Converge Digest — AMD Puts Helios Into Production as AI Reshapes Data Centers (23/07/2026)
- Tom's Hardware — Microsoft will deploy AMD’s Helios rack-scale AI accelerator at scale on Azure (20/07/2026)
Imagem destacada: ilustração gerada por computador, sem valor documental.


