⚡ BREAKING
NVIDIA Onthult Vera Rubin POD Cluster: Vijf Racks, Zeven Chips, 1,2 Biljard Transistoren
NVIDIA
Groq
NVIDIA heeft de Vera Rubin POD geïntroduceerd, een AI-cluster gebaseerd op de derde generatie MGX-architectuur, bestaande uit vijf gespecialiseerde rackplatforms met zeven chiptypes. Het systeem integreert 40 racks, 1,2 biljard transistoren en 1152 Rubin GPU's, met een prestatie van 60 EFLOPS en een interconnectiesnelheid van 10 PB/s. Het cluster omvat NVL72-, LPX-, Vera-, STX- en SPX-racks en is gericht op agentische AI-workloads.
NVIDIA heeft de Vera Rubin POD aangekondigd, een cluster van vijf gespecialiseerde rack-systemen gebaseerd op de derde generatie MGX-architectuur, ontworpen voor het tijdperk van agentieve AI. Het samen ontworpen platform integreert zeven chips die rekenkracht, netwerken en opslag omvatten, waarmee het het meest complexe AI-platform van NVIDIA is. De complete Vera Rubin POD omvat 40 racks, 1,2 quadriljoen transistoren, bijna 20.000 NVIDIA-chips en 1152 Rubin GPU's, waarmee 60 EFLOPS AI-prestaties en ongeveer 10 PB/s geaggregeerde interconnectbandbreedte wordt bereikt. De vijf rackplatforms zijn: Vera Rubin NVL72 (72 Rubin-versnellers en 36 Vera CPU's per rack, verbonden via NVLink 6), Groq LPX (256 LPU-versnellers voor inferentie met lage latentie), Vera CPU-rack (tot 256 processors voor reinforcement learning-omgevingen), BlueField-4 STX opslagrack met CMX contextgeheugen en Spectrum-6 SPX netwerkrack. Het NVL72-rack levert tot 4x betere trainingsprestaties en 10x betere inferentieprestaties per watt vergeleken met Blackwell. Alle MGX-racks gebruiken warmwaterkoeling met een inlaattemperatuur van 45°C, ondersteunen dynamische herverdeling van vermogen en beschikken over intelligente piekvermogenafvlakking die piekbelastingen met 25% vermindert. De Vera Rubin NVL72 staat gepland voor release in de tweede helft van 2026.
Bron: ServerNews —
origineel
