Überblick · letzter Monat
- NVIDIA Groq 3: SRAM, Disaggregation und Determinismus in der neuen KI-Plattform
Die 20 Milliarden Dollar teure Übernahme von Groq durch NVIDIA hat zur Integration von LPU-Beschleunigern in die Vera-Rubin-Plattform geführt, die eine entkoppelte, heterogene KI-Inferenz ermöglicht. Das neue Groq-3-LPX-Rack-System kombiniert 256 LPUs für schnelle, deterministische Token-Generierung, während Vera Rubin NVL72 flexible Trainings- und Inferenzaufgaben übernimmt. Die Plattform zielt auf latenzarme interaktive KI und Multi-Agent-Workloads ab und verspricht bis zu 35-mal schnellere Leistung als Grace Blackwell NVL72 bei 400 TPS pro Benutzer.
Quelle: dnb66 · Überblick —
Original
