Site Local

Portal de notícias de tecnologia

Racks Nvidia Vera Rubin NVL72 começam a rodar cargas de clientes em produção

Em setembro, a Supermicro passou a entregar racks Vera Rubin NVL72 e a CoreWeave pôs o sistema em produção, com a Cognition como primeira cliente.

Racks Nvidia Vera Rubin NVL72 começam a rodar cargas de clientes em produção

A nova geração de sistemas de IA da Nvidia, a Vera Rubin, saiu do anúncio para os data centers de clientes em setembro de 2026. Em 23 de setembro, a Supermicro informou que já enviava racks Vera Rubin NVL72 integrados com refrigeração líquida. Em 30 de setembro, a CoreWeave anunciou a disponibilidade do sistema em sua nuvem e afirmou que a Cognition, criadora do agente de programação Devin, é a primeira cliente no mundo a rodar cargas de produção nele.

O que há em um rack

Segundo a Supermicro, cada rack NVL72 reúne 72 GPUs Rubin e 36 CPUs Vera, distribuídas em 18 bandejas de computação, cada uma com quatro GPUs e duas CPUs. Nove bandejas de switches NVLink de sexta geração oferecem 216 TB/s de banda interna, e o conjunto soma 20,7 TB de memória HBM4 e até 54 TB de LPDDR5X. O sistema foi projetado para refrigeração líquida direta: a Supermicro fornece desde as placas frias sobre os chips até unidades de distribuição de líquido de 1,8 MW, instaladas com redundância N+1. Sua unidade de escala padrão tem 1.152 GPUs em 16 racks, com 331 TB de HBM4, e os projetos vão de 5 MW à escala de gigawatts.

Primeiros resultados, medidos pela cliente

A CoreWeave diz ter montado o cluster para a Cognition no início de setembro. Em texto no blog da Nvidia, a fabricante afirma que a CoreWeave recebeu seus primeiros racks de produção naquele mês. Os engenheiros da Cognition compararam o sistema com um cluster GB200 NVL72, da geração anterior, e mediram até 4,8 vezes mais vazão total de tokens em cargas de inferência do modelo SWE-2 e 3,8 vezes mais tokens de saída em aprendizado por reforço. Os testes foram feitos pela própria cliente, em tarefas escolhidas por ela, e não por um laboratório independente.

A Nvidia, ao anunciar a produção em larga escala em 31 de maio, prometeu dez vezes mais vazão para agentes em relação à plataforma Grace Blackwell. A CoreWeave cita ganho de dez vezes em tokens por megawatt sobre o GB200 NVL72 no modelo DeepSeek R1. São números das empresas, em condições definidas por elas.

Quem chegou primeiro

O título de primeira implantação depende do critério. A CoreWeave fala em primeira cliente com cargas de produção. Já o Tom’s Hardware relatou em 27 de agosto que a Nvidia iniciou em agosto os primeiros embarques faturados de racks, com a Microsoft como primeira a implantar sistemas comerciais, segundo o CEO da empresa, Satya Nadella.

Escala do negócio

Na teleconferência de resultados citada pelo Tom’s Hardware, a diretora financeira da Nvidia, Colette Kress, disse esperar que a Vera Rubin responda por cerca de 20% da receita de data center no terceiro trimestre do ano fiscal de 2027, o que seria a expansão mais rápida da história da empresa, e que todos os grandes provedores de nuvem e fabricantes de sistemas já fizeram pedidos. O site estima algo entre 2.550 e 3.975 racks no trimestre, número que trata como aproximado. Para operadores de data center, a chegada da plataforma reforça a exigência de infraestrutura com refrigeração líquida e alta densidade de energia.

Fontes

Imagem destacada: ilustração gerada por computador, sem valor documental.

Deixe comentário

Seu endereço de e-mail não será publicado. Os campos necessários são marcados com *.

Fique por dentro

As principais notícias de tecnologia, todos os dias

Siga o portal nas redes sociais e acompanhe IA, cibersegurança, cloud, hardware e o mercado de tecnologia em primeira mão.