モデルオープンソース 🇨🇳 28.07.2026 18:03

Qwen2.5-LLM:言語モデルの境界を拡大

Alibaba/QwenAlibaba/Qwen
AlibabaのQwenチームは、Qwen2.5シリーズの言語モデルをリリースしました。このシリーズには0.5Bから72Bパラメータの7つのオープンソースモデルが含まれています。これらのモデルは、最大18兆トークンの大規模な事前学習データセット、強化された知識、コーディング、数学の能力、最大128Kトークンのコンテキスト長をサポートしています。
AlibabaのQwenチームは、Qwen2.5シリーズの言語モデルを発表しました。これらはデコーダーのみの高密度モデルです。7つのモデルがオープンソース化されており、パラメータ数は0.5B、1.5B、3B、7B、14B、32B、72Bとなっています。事前学習データセットは7兆トークンから18兆トークンに拡大されました。Qwen2と比較して、Qwen2.5はMMLU、コーディングベンチマーク(LiveCodeBench、MultiPL-E、MBPP)、および数学ベンチマーク(MATH)で改善を示しています。Qwen2.5-72Bは、Llama-3-405Bの5分の1のパラメータで複数のタスクにおいてこれを上回ります。追加モデルとしてQwen-PlusとQwen-TurboがAlibaba Cloud Model Studio APIを通じて利用可能です。ほとんどのモデルはApache 2.0ライセンスで提供されますが、Qwen2.5-3BとQwen2.5-72Bは別個のライセンスが適用されます。
出典: Alibaba Qwen — 原文
関連記事 ↓
新着ニュース