PesquisaHardware e Inferência 🇺🇸 24.07.2026 00:03

Compressão de Modelos de IA da Multiverse Computing Aumenta Desempenho em Hardware Padrão

Multiverse ComputingMultiverse Computing
A Multiverse Computing apresentou uma tecnologia para comprimir modelos de inteligência artificial que melhora significativamente o desempenho em hardware padrão. A solução permite que grandes modelos de linguagem (LLMs) rodem em GPUs comuns em alta velocidade, reduzindo potencialmente os custos de infraestrutura e tornando a IA mais acessível.
A empresa Multiverse Computing, especializada em computação quântica, anunciou o desenvolvimento de um método de compressão de modelos de IA que acelera significativamente o desempenho em hardware padrão. A tecnologia comprime grandes modelos de linguagem (Large Language Models, LLMs) sem perda significativa de precisão, permitindo executá-los em unidades de processamento gráfico (Graphics Processing Units, GPUs) comuns com desempenho comparável ao uso de chips especializados. Segundo a empresa, isso reduz os custos computacionais e o consumo de energia, tornando modelos avançados de IA mais acessíveis para pequenas e médias empresas. Detalhes específicos sobre os modelos testados ainda não foram divulgados, mas alega-se que o método é aplicável a diversas arquiteturas.
Fonte: Meta AI (GNews) — original
Nossos posts anteriores sobre este tópico ↓
Notícias frescas