Multiverse Computing: CompactifAI lähes kaksinkertaistaa Llama 3.3:n suorituskyvyn Intel Xeon 6:lla
Multiverse Computing
Meta
Intel Corporation
Multiverse Computing ilmoitti, että sen CompactifAI-teknologia pystyy lähes kaksinkertaistamaan Llama 3.3 -mallin suorituskyvyn Intel Xeon 6 -prosessoreilla. Ratkaisu käyttää neuroverkkojen pakkaustekniikoita nopeuttaakseen päättelyä ilman merkittävää tarkkuuden heikkenemistä.
Multiverse Computing ilmoitti, että sen neuroverkkojen pakkausteknologia CompactifAI kykenee lähes kaksinkertaistamaan suuren kielimallin Llama 3.3 suorituskyvyn Intel Xeon 6 -palvelinprosessoreilla. Yrityksen mukaan CompactifAI käyttää kvantti-inspiroituja ja tensori-pakkausmenetelmiä mallin koon pienentämiseen ja päättelyn nopeuttamiseen samalla, kun tarkkuus säilyy korkeana. Testit osoittivat, että Intel Xeon 6 -alustalla, jossa on 288 ydintä, tehtävien suoritusaika lyhenee lähes 50 prosenttia, mikä tekee mallista tehokkaamman datakeskuksissa käytettäväksi. Intel ja Multiverse Computing korostivat, ettei ratkaisu vaadi erityistä laitteistoa, vaan toimii tavallisilla keskusyksiköillä.
Lähde: Meta AI (GNews) —
Alkuperäinen
