Hardware e InferênciaPesquisa 🇺🇸 26.07.2026 20:03

Multiverse Computing: CompactifAI quase dobra desempenho do Llama 3.3 no Intel Xeon 6

Multiverse ComputingMultiverse Computing MetaMeta Intel CorporationIntel Corporation
A Multiverse Computing anunciou que sua tecnologia CompactifAI pode quase dobrar o desempenho do modelo Llama 3.3 quando executado em processadores Intel Xeon 6. A solução utiliza técnicas de compressão de redes neurais para acelerar a inferência sem perda significativa de precisão.
A Multiverse Computing anunciou que sua tecnologia de compressão de redes neurais CompactifAI permite aumentar em quase o dobro a produtividade do grande modelo de linguagem Llama 3.3 quando executado em processadores de servidor Intel Xeon 6. A empresa afirma que a CompactifAI utiliza métodos de compressão inspirados em computação quântica e tensorial para reduzir o tamanho do modelo e acelerar a inferência, mantendo alta precisão. Testes mostraram que, na plataforma Intel Xeon 6 com 288 núcleos, o tempo de execução das tarefas é reduzido em quase 50%, tornando o modelo mais eficiente para implantação em data centers. A Intel e a Multiverse Computing destacaram que a solução não requer hardware especializado e funciona em CPUs padrão.
Fonte: Meta AI (GNews) — original
Nossos posts anteriores sobre este tópico ↓
Notícias frescas