Multiverse Computing: CompactifAI почти удваивает производительность Llama 3.3 на Intel Xeon 6
Multiverse Computing
Meta
Intel Corporation
Технология CompactifAI компании Multiverse Computing почти вдвое увеличивает производительность модели Llama 3.3 от Meta на процессорах Intel Xeon 6, достигая значительного ускорения без потери точности. Решение использует квантово-вдохновлённые методы для оптимизации вывода ИИ.
Компания Multiverse Computing объявила, что ее технология CompactifAI почти вдвое повышает производительность большой языковой модели Llama 3.3 от Meta на процессорах Intel Xeon 6. Оптимизация обеспечивает значительное ускорение инференса без потери точности. CompactifAI использует алгоритмы, вдохновленные квантовыми вычислениями, для сжатия и ускорения моделей ИИ. Это достижение позволяет более
Показать ещё ↓
Источник: Meta AI (GNews) —
оригинал
