Multiverse Computing's AI Model Compression Boosts Performance on Standard Hardware
Multiverse Computing
Multiverse Computing has introduced a technology for compressing AI models that significantly improves performance on standard hardware. The solution enables large language models (LLMs) to run on ordinary GPUs at high speed, potentially reducing infrastructure costs and making AI more accessible.
量子コンピューティング専門企業のMultiverse Computingは、標準的なハードウェア上でAIモデルの動作を大幅に高速化する圧縮手法を開発したと発表した。この技術は、大規模言語モデル(LLM)を精度を大きく損なうことなく圧縮し、専用チップを使うのと同等のパフォーマンスで通常のグラフィックスプロセッシングユニット(GPU)上で実行可能にする。同社によれば、これにより計算コストと消費電力を削減し、先進的なAIモデルを中小企業にとってより利用しやすくする。具体的にどのモデルでテストが行われたかの詳細はまだ明らかにされていないが、この手法はさまざまなアーキテクチャに適用可能だとされている。
出典: Meta AI (GNews) —
原文
