Ringkasan · bulan lalu
- NVIDIA Groq 3: SRAM, Disagregasi, dan Determinisme di Platform AI Baru
Akuisisi Groq senilai $20 miliar oleh NVIDIA menghasilkan integrasi akselerator LPU ke dalam platform Vera Rubin, memungkinkan inferensi AI yang terdisagregasi dan heterogen. Sistem rak Groq 3 LPX yang baru menggabungkan 256 LPU untuk pembuatan token yang cepat dan deterministik, sementara Vera Rubin NVL72 menangani pelatihan dan inferensi yang fleksibel. Platform ini menargetkan AI interaktif dengan latensi rendah dan beban kerja multi-agen, menjanjikan kinerja hingga 35 kali lebih cepat daripada Grace Blackwell NVL72 pada 400 TPS per pengguna.
Sumber: dnb66 · Ringkasan —
asli
