Multiverse Computing's AI Model Compression Boosts Performance on Standard Hardware
Multiverse Computing
Multiverse Computing has introduced a technology for compressing AI models that significantly improves performance on standard hardware. The solution enables large language models (LLMs) to run on ordinary GPUs at high speed, potentially reducing infrastructure costs and making AI more accessible.
Компания Multiverse Computing, специализирующаяся на квантовых вычислениях, объявила о разработке метода компрессии ИИ-моделей, который позволяет существенно ускорить работу на стандартном оборудовании. Технология сжимает большие языковые модели (Large Language Models, LLM) без значительной потери точности, что даёт возможность запускать их на обычных графических процессорах (Graphics Processing Units, GPU) с производительностью, сравнимой с использованием специализированных чипов. По заявлению компании, это сокращает вычислительные затраты и энергопотребление, делая передовые модели ИИ более доступными для малого и среднего бизнеса. Пока не раскрыты детали конкретных моделей, с которыми проводилось тестирование, но утверждается, что метод применим к различным архитектурам.
Nguồn: Meta AI (GNews) —
bản gốc
