モデルオープンソース 🇨🇳 28.07.2026 18:03

AlibabaがQwen2.5-Mathをリリース:最先端のオープン数学LLM

Alibaba/QwenAlibaba/Qwen OpenAIOpenAI Google/DeepMindGoogle/DeepMind AnthropicAnthropic
AlibabaはQwen2.5-Math、新しいシリーズのオープン数学言語モデルを発表しました。これは1.5Bから72Bパラメータのモデルを含み、英語と中国語での数学問題解決をサポートし、連鎖推論と統合ツール思考を用いて、前世代のQwen2-Mathを大幅に上回ります。
Alibabaは新たなオープンな数学特化LLMシリーズ「Qwen2.5-Math」を発表しました。このシリーズには、ベースモデルのQwen2.5-Math-1.5B/7B/72B、インストラクションチューニング版、そして数学用報酬モデルQwen2.5-Math-RM-72Bが含まれます。Qwen2-Mathとは異なり、新しいモデルは英語と中国語の両方での問題解決を、思考連鎖(Chain of Thought、CoT)と統合ツール思考(Tool-Integrated Reasoning、TIR)の両方でサポートします。TIRにより計算精度が向上し、複雑なアルゴリズム操作が可能になります。MATHベンチマークにおいて、TIRを使ったQwen2.5-Math-1.5B/7B/72B-Instructはそれぞれ79.7、85.3、87.8点を達成しました。事前学習には、1兆トークン以上の規模を持つQwen Math Corpus v2が使用されています。72B-Instructモデルは、TIRを用いたMATHで92.9点を記録し、GPT-4oやGemini Math-Specialized 1.5 Proを上回りました。7B-InstructモデルはQwen2-Math-72B-Instructを凌駕しました。また、難関のオリンピックレベルの試験であるAIME 2024やAMC 2023でも高いスコアを示しました。データ漏洩を防ぐため、データの汚染除去(デコンタミネーション)が実施されています。デモ版はTIR対応で利用可能です。
出典: Alibaba Qwen — 原文
関連記事 ↓
新着ニュース