Perangkat Keras & InferensiRiset 🇺🇸 26.07.2026 20:03

Multiverse Computing: CompactifAI nearly doubles Llama 3.3 performance on Intel Xeon 6

Multiverse ComputingMultiverse Computing MetaMeta Intel CorporationIntel Corporation
Multiverse Computing announced that its CompactifAI technology can nearly double the performance of the Llama 3.3 model when running on Intel Xeon 6 processors. The solution uses neural network compression techniques to accelerate inference without significant loss of accuracy.
Multiverse Computing mengumumkan bahwa teknologi kompresi jaringan saraf mereka, CompactifAI, mampu meningkatkan performa model bahasa besar Llama 3.3 hampir dua kali lipat saat dijalankan di prosesor server Intel Xeon 6. Perusahaan tersebut mengklaim bahwa CompactifAI menggunakan metode kompresi yang terinspirasi dari kuantum dan tensor untuk mengurangi ukuran model serta mempercepat inferensi, sambil tetap mempertahankan akurasi tinggi. Pengujian menunjukkan bahwa pada platform Intel Xeon 6 dengan 288 inti, waktu eksekusi task berkurang hampir 50%, sehingga model menjadi lebih efisien untuk diterapkan di pusat data. Intel dan Multiverse Computing menekankan bahwa solusi ini tidak memerlukan perangkat keras khusus dan dapat berjalan pada CPU standar.
Sumber: Meta AI (GNews) — asli
Postingan kami sebelumnya tentang topik ini ↓
Berita terbaru