Groq、3週間でLlama-2 70Bの推論性能を2倍に
Meta
Groq
Groq社は、わずか3週間でLlama-2 70Bモデルの推論性能を2倍に引き上げたと発表しました。この改善は、ハードウェアとソフトウェアの最適化によって達成されました。現在、このシステムは1ストリームあたり毎秒1250トークン以上を処理します。
AI推論ハードウェアとソフトウェアを専門とする企業Groqは、Metaの大規模言語モデルLlama-2 70Bの推論性能をわずか3週間で2倍にしたと発表しました。この大きな性能向上は、基盤となるハードウェアには一切変更を加えず、ソフトウェアの最適化のみで達成されました。同社は、これらの改善により、AIモデルの推論効率を高める自社のソフトウェアスタックの可能性が実証されたと述べています。この進展は、大規模なAIモデルの高速処理を必要とするアプリケーションにとって特に重要です。
出典: Meta AI (GNews) —
原文
