ملخص · الشهر الماضي

  1. NVIDIA Groq 3: SRAM والفصل والحتمية في منصة الذكاء الاصطناعي الجديدة
    استحواذ NVIDIA بقيمة 20 مليار دولار على Groq أسفر عن دمج مسرعات LPU في منصة Vera Rubin، مما يتيح استنتاجًا غير متجانس ومفصولًا للذكاء الاصطناعي. يجمع نظام Groq 3 LPX الجديد بين 256 وحدة LPU لتوليد رمز سريع وحتمي، بينما تتعامل Vera Rubin NVL72 مع التدريب والاستنتاج المرنين. تستهدف المنصة تطبيقات الذكاء الاصطناعي التفاعلية منخفضة الكمون وأعباء العمل متعددة العوامل، واعدة بأداء أسرع يصل إلى 35 مرة من Grace Blackwell NVL72 بمعدل 400 رمز في الثانية لكل مستخدم.
المصدر: dnb66 · ملخص — الأصلي
منشوراتنا السابقة حول هذا الموضوع ↓
أخبار جديدة