Multiverse Computing: CompactifAI verdubbelt bijna de prestaties van Llama 3.3 op Intel Xeon 6
Multiverse Computing
Meta
Intel Corporation
Multiverse Computing heeft aangekondigd dat zijn CompactifAI-technologie de prestaties van het Llama 3.3-model bijna kan verdubbelen wanneer het draait op Intel Xeon 6-processors. De oplossing maakt gebruik van neurale netwerkcompressietechnieken om de inferentie te versnellen zonder significant verlies van nauwkeurigheid.
Multiverse Computing heeft aangekondigd dat haar technologie voor het comprimeren van neurale netwerken, CompactifAI, de prestaties van het grote taalmodel Llama 3.3 bijna kan verdubbelen wanneer het draait op Intel Xeon 6-serverprocessors. Het bedrijf stelt dat CompactifAI gebruikmaakt van kwantum-geïnspireerde en tensorcompressiemethoden om de modelgrootte te verkleinen en de inferentie te versnellen, terwijl de hoge nauwkeurigheid behouden blijft. Tests hebben aangetoond dat op het Intel Xeon 6-platform met 288 cores de uitvoeringstijd van taken met bijna 50% afneemt, waardoor het model efficiënter wordt voor implementatie in datacenters. Intel en Multiverse Computing benadrukten dat de oplossing geen speciale hardware vereist en werkt op standaard cpu's.
Bron: Meta AI (GNews) —
origineel
