NVIDIA Groq 3: ذاكرة SRAM والفصل والحتمية في منصة الذكاء الاصطناعي الجديدة
بعد استحواذ NVIDIA على شركة Groq مقابل 20 مليار دولار، قامت بدمج مسرعات LPU في منصة Vera Rubin، مما أدى إلى إنشاء بنية غير متجانسة للاستدلال. يعمل مسرع الرف الجديد Groq 3 LPX، استنادًا إلى رقائق Groq 3 LP30 بسعة 500 ميجابايت من ذاكرة SRAM وعرض نطاق ترددي للذاكرة يبلغ 150 تيرابايت في الثانية، على ضمان التنفيذ الحتمي وزمن انتقال منخفض. يتيح الفصل القائم على المرحلة لفك الترميز (AFD) فصل حسابات FFN عن الانتباه، مما يوزع عبء العمل بين وحدات معالجة الرسومات ووحدات LPU.
NVIDIA
Groq
