Hardware & InferenzForschung 🇺🇸 26.07.2026 20:03

Multiverse Computing: CompactifAI verdoppelt fast die Leistung von Llama 3.3 auf Intel Xeon 6

Multiverse ComputingMultiverse Computing MetaMeta Intel CorporationIntel Corporation
Multiverse Computing gab bekannt, dass seine CompactifAI-Technologie die Leistung des Llama 3.3-Modells auf Intel Xeon 6-Prozessoren nahezu verdoppeln kann. Die Lösung nutzt neuronale Netzwerk-Kompressionstechniken, um die Inferenz zu beschleunigen, ohne dass es zu nennenswerten Genauigkeitsverlusten kommt.
Multiverse Computing hat angekündigt, dass ihre Technologie zur Komprimierung neuronaler Netze, CompactifAI, die Leistung des großen Sprachmodells Llama 3.3 bei Betrieb auf den Server-Prozessoren Intel Xeon 6 nahezu verdoppeln kann. Das Unternehmen behauptet, dass CompactifAI Methoden der quanteninspirierten und Tensor-Komprimierung einsetzt, um die Modellgröße zu reduzieren und die Inferenz zu beschleunigen, während eine hohe Genauigkeit erhalten bleibt. Tests haben gezeigt, dass auf der Intel Xeon 6-Plattform mit 288 Kernen die Ausführungszeit der Aufgaben um fast 50% reduziert wird, was das Modell für den Einsatz in Rechenzentren effizienter macht. Intel und Multiverse Computing betonten, dass die Lösung keine spezielle Hardware erfordert und auf Standard-CPUs funktioniert.
Quelle: Meta AI (GNews) — Original
Unsere früheren Beiträge zu diesem Thema ↓
Aktuelle Nachrichten