Matériel et InférenceRecherche 🇺🇸 26.07.2026 20:03

Multiverse Computing : CompactifAI double presque les performances de Llama 3.3 sur Intel Xeon 6

Multiverse ComputingMultiverse Computing MetaMeta Intel CorporationIntel Corporation
Multiverse Computing a annoncé que sa technologie CompactifAI peut presque doubler les performances du modèle Llama 3.3 lorsqu'il est exécuté sur des processeurs Intel Xeon 6. La solution utilise des techniques de compression de réseaux de neurones pour accélérer l'inférence sans perte significative de précision.
Multiverse Computing a annoncé que sa technologie de compression de réseaux de neurones, CompactifAI, permet d’augmenter de près de 50 % les performances du grand modèle de langage Llama 3.3 sur les processeurs serveurs Intel Xeon 6. L’entreprise affirme que CompactifAI utilise des méthodes de compression d’inspiration quantique et tensorielle pour réduire la taille du modèle et accélérer l’inférence, tout en maintenant une haute précision. Les tests ont montré que sur la plateforme Intel Xeon 6 à 288 cœurs, le temps d’exécution des tâches est réduit de près de 50 %, rendant le modèle plus efficace pour le déploiement dans les centres de données. Intel et Multiverse Computing ont souligné que la solution ne nécessite pas de matériel spécialisé et fonctionne sur des processeurs standard.
Source: Meta AI (GNews) — original
Nos articles précédents sur ce sujet ↓
Infos fraîches