Multiverse Computing:CompactifAI 技术在 Intel Xeon 6 上使 Llama 3.3 性能近乎翻倍
Multiverse Computing
Meta
Intel Corporation
Multiverse Computing 的 CompactifAI 技术在 Intel Xeon 6 处理器上使 Meta 的 Llama 3.3 模型性能近乎翻倍,实现了显著的加速且不牺牲准确性。该方案采用量子启发技术优化人工智能推理。
Multiverse Computing 宣布,其 CompactifAI 技术使 Meta 的 Llama 3.3 大语言模型在英特尔至强 6 处理器上的性能几乎翻倍。这项优化在不牺牲准确性的前提下实现了显著的推理加速。CompactifAI 采用受量子启发的算法来压缩和加速 AI 模型。这一进展使得大语言模型能够更高效地部署在标准服务器硬件上。
来源: Meta AI (GNews) —
原文
