Multiverse Computing: CompactifAI steigert Leistung von Llama 3.3 auf Intel Xeon 6 um fast das Doppelte
Multiverse Computing
Meta
Intel Corporation
Die CompactifAI-Technologie von Multiverse Computing verdoppelt nahezu die Leistung von Metas Llama 3.3-Modell auf Intel Xeon 6-Prozessoren und erzielt deutliche Beschleunigungen ohne Genauigkeitseinbußen. Die Lösung nutzt quanten-inspirierte Techniken zur Optimierung der KI-Inferenz.
Multiverse Computing hat bekannt gegeben, dass seine CompactifAI-Technologie die Leistung des großen Sprachmodells Llama 3.3 von Meta auf Intel-Xeon-6-Prozessoren nahezu verdoppelt. Die Optimierung erreicht erhebliche Beschleunigungen bei Inferenzen, ohne die Genauigkeit zu beeinträchtigen. CompactifAI nutzt quanteninspirierte Algorithmen, um KI-Modelle zu komprimieren und zu beschleunigen. Diese Entwicklung ermöglicht eine effizientere Bereitstellung großer Sprachmodelle auf Standard-Serverhardware.
Quelle: Meta AI (GNews) —
Original
