Компрессия ИИ-моделей от Multiverse Computing ускоряет работу на обычном оборудовании
Multiverse Computing
Компания Multiverse Computing представила технологию сжатия ИИ-моделей, которая значительно повышает производительность на стандартном аппаратном обеспечении. Решение позволяет запускать большие языковые модели (LLM) на обычных GPU с высокой скоростью, что может снизить затраты на инфраструктуру и сделать ИИ доступнее.
Компания Multiverse Computing, специализирующаяся на квантовых вычислениях, объявила о разработке метода компрессии ИИ-моделей, который позволяет существенно ускорить работу на стандартном оборудовании. Технология сжимает большие языковые модели (LLM) без значительной потери точности, что даёт возможность запускать их на обычных графических процессорах (GPU) с производительностью, сравнимой с
Показать ещё ↓
- Сокращения
- LLM = Large Language Model — большая языковая модель
- GPU = Graphics Processing Unit — графический процессор
Источник: Meta AI (GNews) —
оригинал
