Multiverse Computing: CompactifAI, Llama 3.3 performansını Intel Xeon 6 üzerinde neredeyse ikiye katlıyor
Multiverse Computing
Meta
Intel Corporation
Multiverse Computing'in CompactifAI teknolojisi, Meta'nın Llama 3.3 modelinin performansını Intel Xeon 6 işlemcilerde neredeyse ikiye katlayarak doğruluktan ödün vermeden önemli hızlanmalar sağlıyor. Çözüm, yapay zeka çıkarımını optimize etmek için kuantum esinli teknikler kullanıyor.
Multiverse Computing, CompactifAI teknolojisinin, Meta'nın Llama 3.3 büyük dil modelinin Intel Xeon 6 işlemcilerdeki performansını neredeyse iki katına çıkardığını duyurdu. Optimizasyon, doğruluktan ödün vermeden çıkarımda önemli hızlanmalar sağlıyor. CompactifAI, yapay zeka modellerini sıkıştırmak ve hızlandırmak için kuantum esinli algoritmalar kullanıyor. Bu gelişme, büyük dil modellerinin standart sunucu donanımlarında daha verimli bir şekilde dağıtılmasını sağlıyor.
Kaynak: Meta AI (GNews) —
orijinal
