ModellerAçık Kaynak 🇨🇳 28.07.2026 18:03

Alibaba, Qwen2.5-Math'i Yayınladı: En Gelişmiş Açık Matematiksel Diller

Alibaba/QwenAlibaba/Qwen OpenAIOpenAI Google/DeepMindGoogle/DeepMind AnthropicAnthropic
Alibaba, 1,5 milyar ile 72 milyar parametre arasında modeller içeren yeni bir açık matematiksel dil modeli serisi olan Qwen2.5-Math'i tanıttı. Modeller, zincirleme düşünme ve entegre araçsal akıl yürütme kullanarak İngilizce ve Çince matematik problemlerini çözme desteği sunuyor ve önceki nesil Qwen2-Math'ten önemli ölçüde daha iyi performans gösteriyor.
Alibaba, Qwen2.5-Math serisini yayınladı. Bu yeni açık matematik LLM serisi; Qwen2.5-Math-1.5B/7B/72B temel modellerini, talimat sürümlerini ve Qwen2.5-Math-RM-72B matematiksel ödül modelini içeriyor. Qwen2-Math'ın aksine, yeni modeller hem İngilizce hem de Çince dillerinde problem çözmeyi destekliyor. Bunu hem akıl yürütme zinciri (Chain of Thought, CoT) hem de entegre araçsal akıl yürütme (Tool-Integrated Reasoning, TIR) ile gerçekleştiriyor. TIR, hesaplama doğruluğunu artırıyor ve karmaşık algoritmik işlemleri gerçekleştirmeyi sağlıyor. MATH benchmark'ında, TIR ile Qwen2.5-Math-1.5B/7B/72B-Instruct modelleri sırasıyla 79,7, 85,3 ve 87,8 puan aldı. Ön eğitim için 1 trilyon token'ı aşan hacimde Qwen Math Corpus v2 adlı bir derlem kullanıldı. 72B-Instruct modelleri, TIR ile MATH'da 92,9 puan alarak GPT-4o ve Gemini Math-Specialized 1.5 Pro'yu geride bıraktı. 7B-Instruct modeli ise Qwen2-Math-72B-Instruct'ı geçti. Zorlu olimpiyat testleri AIME 2024 ve AMC 2023'te de modeller yüksek sonuçlar elde etti. Veri sızıntısını önlemek için dekontaminasyon işlemi uygulandı. Demo sürümü TIR desteği ile kullanıma sunuldu.
Kaynak: Alibaba Qwen — orijinal
Bu konudaki önceki yazılarımız ↓
Güncel haberler