Multiverse Computing: CompactifAI تضاعف أداء Llama 3.3 تقريبًا على معالجات Intel Xeon 6
Multiverse Computing
Meta
Intel Corporation
أعلنت شركة Multiverse Computing أن تقنيتها CompactifAI يمكنها مضاعفة أداء نموذج Llama 3.3 تقريبًا عند تشغيله على معالجات Intel Xeon 6. يستخدم الحل تقنيات ضغط الشبكات العصبية لتسريع الاستدلال دون فقدان كبير في الدقة.
أعلنت شركة Multiverse Computing أن تقنيتها لضغط الشبكات العصبية CompactifAI تسمح بزيادة أداء نموذج اللغة الكبير Llama 3.3 بنحو الضعف عند تشغيله على معالجات الخوادم Intel Xeon 6. وتؤكد الشركة أن CompactifAI تستخدم أساليب الضغط المستوحاة من الحوسبة الكمومية وضغط الموترات لتقليل حجم النموذج وتسريع عملية الاستدلال، مع الحفاظ على دقة عالية. أظهرت الاختبارات أن وقت تنفيذ المهام ينخفض بنحو 50% على منصة Intel Xeon 6 المزودة بـ 288 نواة، مما يجعل النموذج أكثر كفاءة للنشر في مراكز البيانات. وأكدت كل من Intel وMultiverse Computing أن الحل لا يتطلب أجهزة خاصة ويعمل على وحدات المعالجة المركزية القياسية.
المصدر: Meta AI (GNews) —
الأصلي
