ModellerAçık Kaynak 🇨🇳 28.07.2026 17:04

Alibaba, Qwen2.5-Turbo'nun Bağlam Uzunluğunu 1 Milyon Token'a Çıkardı

Alibaba/QwenAlibaba/Qwen OpenAIOpenAI
Alibaba, Qwen2.5-Turbo'yu yayınladı ve bağlam uzunluğunu 128K'dan 1M token'a çıkardı. Model, 1M Passkey Retrieval görevinde %100 doğruluk elde ederken, RULER kıyaslamasında 93.1 puan alarak GPT-4'ü geride bıraktı. Seyrek dikkat mekanizması kullanılarak çıkarım hızı 4,3 kata kadar iyileştirilirken, maliyetler 1 milyon token başına 0,3 Yuan seviyesinde kaldı.
Alibaba, Qwen2.5-Turbo modelini duyurdu. Bu model, bağlam uzunluğunu 128K'dan 1M token'a çıkararak yaklaşık 1 milyon İngilizce kelimeye veya 1,5 milyon Çince karaktere eşdeğer hale getiriyor. Model, 1M uzunluğundaki Passkey Retrieval görevinde %100 doğruluk oranına ulaşırken, uzun metin değerlendirme kıyaslaması RULER'da 93,1 puan alarak GPT-4'ün 91,6 ve GLM4-9B-1M'in 89,9 puanını geride bırakıyor. Seyrek dikkat mekanizmaları sayesinde, 1M token bağlamı için ilk token üretim süresi 4,9 dakikadan 68 saniyeye düşerek 4,3 kat hızlanma sağlanıyor. Fiyatı 1M token başına 0,3 yuan olarak kalırken, Qwen2.5-Turbo aynı maliyetle GPT-4o-mini'ye kıyasla 3,6 kat daha fazla token işleyebiliyor. Model, GPT-4o-mini ile rekabet edebilecek kısa dizi yeteneklerini de koruyor. Alibaba Cloud Model Studio API, HuggingFace Demo ve ModelScope Demo üzerinden kullanılabilir.
Kaynak: Alibaba Qwen — orijinal
Bu konudaki önceki yazılarımız ↓
Güncel haberler