Hardware e InferenciaInvestigación 🇺🇸 26.07.2026 20:03

Multiverse Computing: CompactifAI casi duplica el rendimiento de Llama 3.3 en Intel Xeon 6

Multiverse ComputingMultiverse Computing MetaMeta Intel CorporationIntel Corporation
Multiverse Computing anunció que su tecnología CompactifAI puede casi duplicar el rendimiento del modelo Llama 3.3 cuando se ejecuta en procesadores Intel Xeon 6. La solución utiliza técnicas de compresión de redes neuronales para acelerar la inferencia sin una pérdida significativa de precisión.
Multiverse Computing ha anunciado que su tecnología de compresión de redes neuronales, CompactifAI, permite casi duplicar el rendimiento del modelo de lenguaje grande Llama 3.3 al ejecutarse en procesadores para servidores Intel Xeon 6. La compañía afirma que CompactifAI aplica métodos de compresión cuántico-inspirada y tensorial para reducir el tamaño del modelo y acelerar la inferencia, manteniendo al mismo tiempo una alta precisión. Las pruebas han demostrado que, en la plataforma Intel Xeon 6 con 288 núcleos, el tiempo de ejecución de las tareas se reduce casi un 50%, lo que hace que el modelo sea más eficiente para su despliegue en centros de datos. Intel y Multiverse Computing han destacado que la solución no requiere hardware especializado y funciona en CPU estándar.
Fuente: Meta AI (GNews) — original
Nuestros artículos anteriores sobre este tema ↓
Noticias frescas