Tag: inferência
Racks Nvidia Vera Rubin NVL72 começam a rodar cargas de clientes em produção
Em setembro, a Supermicro passou a entregar racks Vera Rubin NVL72 e a CoreWeave pôs o sistema em produção, com a Cognition como primeira cliente.
Leia maisNvidia põe em produção o Groq 3 LPX, primeiro chip derivado da compra da Groq, focado em inferência rápida
Desde 24/8 em produção plena, o LPX usa 256 chips com SRAM por rack para acelerar respostas de IA; a Nebius será a primeira nuvem a oferecer.
Leia mais