モデルハードウェア・推論 🇺🇸 26.07.2026 20:03

Multiverse ComputingのCompactifAI、Intel Xeon 6上でLlama 3.3のパフォーマンスをほぼ2倍に

Multiverse ComputingMultiverse Computing MetaMeta Intel CorporationIntel Corporation
Multiverse ComputingのCompactifAI技術により、MetaのLlama 3.3モデルがIntel Xeon 6プロセッサ上でほぼ2倍のパフォーマンス向上を達成。精度を犠牲にすることなく大幅な高速化を実現しました。このソリューションは量子インスパイア技術を用いてAI推論を最適化します。
Multiverse Computingは、同社のCompactifAI技術により、Intel Xeon 6プロセッサ上でMetaの大規模言語モデルLlama 3.3の性能がほぼ2倍になったと発表しました。この最適化により、精度を犠牲にすることなく推論速度が大幅に向上します。CompactifAIは量子に着想を得たアルゴリズムを使用して、AIモデルの圧縮と高速化を実現します。この開発により、標準的なサーバーハードウェア上でのLLMのより効率的な展開が可能になります。
出典: Meta AI (GNews) — 原文
関連記事 ↓
新着ニュース