Hardware e Inferência RSS

Hardware e Inferência 🇷🇺

NVIDIA Groq 3: SRAM, Desagregação e Determinismo na Nova Plataforma de IA

A aquisição de US$ 20 bilhões da Groq pela NVIDIA resultou na integração dos aceleradores LPU na plataforma Vera Rubin, permitindo inferência de IA desagregada e heterogênea. O novo sistema rack Groq 3 LPX combina 256 LPUs para geração de tokens rápida e determinística, enquanto o Vera Rubin NVL72 lida com treinamento e inferência flexíveis. A plataforma visa aplicações de IA interativa de baixa latência e cargas de trabalho multiagente, prometendo desempenho até 35 vezes mais rápido que o Grace Blackwell NVL72 a 400 TPS por usuário.

NVIDIANVIDIA GroqGroq
ServerNews27.07 · 15:06
Hardware e Inferência 🇷🇺

Nvidia apresenta cluster Vera Rubin POD: cinco racks, sete chips, 1,2 quatrilhão de transistores

A Nvidia apresentou o Vera Rubin POD, um cluster de IA construído sobre a arquitetura MGX de terceira geração, composto por cinco plataformas de rack especializadas com sete tipos de chips. O sistema integra 40 racks, 1,2 quatrilhão de transistores e 1152 GPUs Rubin, entregando desempenho de 60 EFLOPS e velocidade de interconexão de 10 PB/s. O cluster inclui racks NVL72, LPX, Vera, STX e SPX, voltados para cargas de trabalho de IA agêntica.

NVIDIANVIDIA GroqGroq
ServerNews27.07 · 15:05
Notícias frescas