Racks Nvidia Vera Rubin NVL72 começam a rodar cargas de clientes em produção
Em setembro, a Supermicro passou a entregar racks Vera Rubin NVL72 e a CoreWeave pôs o sistema em produção, com a Cognition como primeira cliente.
A nova geração de sistemas de IA da Nvidia, a Vera Rubin, saiu do anúncio para os data centers de clientes em setembro de 2026. Em 23 de setembro, a Supermicro informou que já enviava racks Vera Rubin NVL72 integrados com refrigeração líquida. Em 30 de setembro, a CoreWeave anunciou a disponibilidade do sistema em sua nuvem e afirmou que a Cognition, criadora do agente de programação Devin, é a primeira cliente no mundo a rodar cargas de produção nele.
O que há em um rack
Segundo a Supermicro, cada rack NVL72 reúne 72 GPUs Rubin e 36 CPUs Vera, distribuídas em 18 bandejas de computação, cada uma com quatro GPUs e duas CPUs. Nove bandejas de switches NVLink de sexta geração oferecem 216 TB/s de banda interna, e o conjunto soma 20,7 TB de memória HBM4 e até 54 TB de LPDDR5X. O sistema foi projetado para refrigeração líquida direta: a Supermicro fornece desde as placas frias sobre os chips até unidades de distribuição de líquido de 1,8 MW, instaladas com redundância N+1. Sua unidade de escala padrão tem 1.152 GPUs em 16 racks, com 331 TB de HBM4, e os projetos vão de 5 MW à escala de gigawatts.
Primeiros resultados, medidos pela cliente
A CoreWeave diz ter montado o cluster para a Cognition no início de setembro. Em texto no blog da Nvidia, a fabricante afirma que a CoreWeave recebeu seus primeiros racks de produção naquele mês. Os engenheiros da Cognition compararam o sistema com um cluster GB200 NVL72, da geração anterior, e mediram até 4,8 vezes mais vazão total de tokens em cargas de inferência do modelo SWE-2 e 3,8 vezes mais tokens de saída em aprendizado por reforço. Os testes foram feitos pela própria cliente, em tarefas escolhidas por ela, e não por um laboratório independente.
A Nvidia, ao anunciar a produção em larga escala em 31 de maio, prometeu dez vezes mais vazão para agentes em relação à plataforma Grace Blackwell. A CoreWeave cita ganho de dez vezes em tokens por megawatt sobre o GB200 NVL72 no modelo DeepSeek R1. São números das empresas, em condições definidas por elas.
Quem chegou primeiro
O título de primeira implantação depende do critério. A CoreWeave fala em primeira cliente com cargas de produção. Já o Tom’s Hardware relatou em 27 de agosto que a Nvidia iniciou em agosto os primeiros embarques faturados de racks, com a Microsoft como primeira a implantar sistemas comerciais, segundo o CEO da empresa, Satya Nadella.
Escala do negócio
Na teleconferência de resultados citada pelo Tom’s Hardware, a diretora financeira da Nvidia, Colette Kress, disse esperar que a Vera Rubin responda por cerca de 20% da receita de data center no terceiro trimestre do ano fiscal de 2027, o que seria a expansão mais rápida da história da empresa, e que todos os grandes provedores de nuvem e fabricantes de sistemas já fizeram pedidos. O site estima algo entre 2.550 e 3.975 racks no trimestre, número que trata como aproximado. Para operadores de data center, a chegada da plataforma reforça a exigência de infraestrutura com refrigeração líquida e alta densidade de energia.
Fontes
- Supermicro — Supermicro Now Shipping NVIDIA Vera Rubin NVL72 Racks (23/09/2026)
- CoreWeave — CoreWeave Delivers NVIDIA Vera Rubin NVL72 Performance at Production Scale, Starting With Cognition (30/09/2026)
- NVIDIA (blog) — From Training to Production, NVIDIA and CoreWeave Close the Loop on Agentic AI (30/09/2026)
- NVIDIA (Newsroom) — NVIDIA Vera Rubin Ramps Into Full Production to Power Agentic AI Factories Worldwide (31/05/2026)
- Tom's Hardware — Nvidia expects to sell $20 billion of Vera Rubin systems in Q3 as shipments begin (27/08/2026)
Imagem destacada: ilustração gerada por computador, sem valor documental.


