연구하드웨어 및 추론 🇺🇸 24.07.2026 00:03

Multiverse Computing's AI Model Compression Boosts Performance on Standard Hardware

Multiverse ComputingMultiverse Computing
Multiverse Computing has introduced a technology for compressing AI models that significantly improves performance on standard hardware. The solution enables large language models (LLMs) to run on ordinary GPUs at high speed, potentially reducing infrastructure costs and making AI more accessible.
Компания Multiverse Computing, специализирующаяся на квантовых вычислениях, объявила о разработке метода сжатия ИИ-моделей, который позволяет значительно ускорить работу на стандартном оборудовании. Технология сжимает большие языковые модели (Large Language Model, LLM) без существенной потери точности, что дает возможность запускать их на обычных графических процессорах (Graphics Processing Unit, GPU) с производительностью, сравнимой с использованием специализированных чипов. По заявлению компании, это сокращает вычислительные затраты и энергопотребление, делая передовые модели ИИ более доступными для малого и среднего бизнеса. Пока не раскрыты детали конкретных моделей, на которых проводилось тестирование, но утверждается, что метод применим к различным архитектурам.
출처: Meta AI (GNews) — 원문
관련 게시물 ↓
새로운 뉴스