Groq

Neueste KI-Nachrichten, Modelle und Releases von Groq. ['Groq 3 LP30', 'Groq 3 LPU', 'Groq 3 LPX', 'llama-3.3-70b', 'LPU', 'RealScale']

Hardware & Inferenz 🇷🇺

NVIDIA Groq 3: SRAM, Disaggregation und Determinismus in der neuen KI-Plattform

Nach der Übernahme von Groq für 20 Milliarden US-Dollar integrierte NVIDIA die LPU-Beschleuniger in die Vera-Rubin-Plattform und schuf so eine heterogene Architektur für Inferenz. Der neue Groq-3-LPX-Rack-Beschleuniger, basierend auf Groq-3-LP30-Chips mit 500 MB SRAM und 150 TB/s Speicherbandbreite, gewährleistet deterministische Ausführung und niedrige Latenz. Die phasenbasierte Disaggregation der Dekodierung (AFD) ermöglicht die Trennung der FFN-Berechnungen von der Aufmerksamkeit und verteilt die Arbeitslast zwischen GPUs und LPUs.

NVIDIANVIDIA GroqGroq
ServerNews27.07 · 15:06

NVIDIA stellt Vera Rubin POD Cluster vor: Fünf Racks, Sieben Chips, 1,2 Billiarden Transistoren

NVIDIA kündigte den Vera Rubin POD Cluster an, der auf der dritten Generation der MGX-Architektur basiert. Er umfasst fünf Rack-Typen: NVL72, LPX, Vera, STX und SPX, und integriert 1.152 Rubin GPUs, 36 Vera CPUs sowie weitere Komponenten. Der Cluster bietet eine Leistung von 60 Exaflops und eine Verbindungsgeschwindigkeit von 10 PB/s.

NVIDIANVIDIA GroqGroq
ServerNews27.07 · 15:05
Aktuelle Nachrichten