Modellerİş ve Pazar 🇷🇺 10.08.2026 14:01

Qwen3.8 Max Yayınlandı: Milyon Token Başına 6 Dolarla Ajan İndeksinde Claude Fable 5'i Geride Bırakıyor

Alibaba/QwenAlibaba/Qwen AnthropicAnthropic
Alibaba, 2,4 trilyon parametreli çok modlu bir model olan ve milyon token bağlamına sahip Qwen3.8 Max'in son sürümünü yayınladı. Bağımsız testler, Ajan İndeksinde Claude Fable 5'i geride bıraktığını gösteriyor ve API fiyatlandırması rakiplerine kıyasla önemli ölçüde daha düşük. Ancak, açık ağırlıklar hâlâ bekleniyor.
Alibaba, 2,4 trilyon parametreli yerel çok modlu uzman karışımı modeli Qwen3.8 Max'ı resmi olarak yayınladı. Model metin, görüntü ve video girişini destekliyor ve metin çıkışı sağlıyor; düşünme modunda bir milyon tokena (983.000 giriş ve 131.000 çıkış tokenı) kadar bağlam penceresi sunuyor. Model, varsayılan olarak etkin olan hibrit düşünme, fonksiyon çağırma ve yerleşik araçlara sahip ve programlama ile profesyonel aracı iş akışları için tanıtılıyor. Artificial Analysis tarafından yapılan bağımsız testler, Qwen3.8 Max'ın Zeka Endeksi'nde 58,1 (Claude Fable 5 için 62,1'e karşı) ve Aracı Endeksi'nde 58,4 (Claude Fable 5 için 56,6'ya karşı) puan aldığını ve yalnızca iki Claude Opus 5 modunun daha yüksek sıralamada yer aldığını gösteriyor. Fiyatlandırma, milyon giriş tokenı başına 2 ABD doları ve milyon çıkış tokenı başına 6 ABD doları olarak belirlenmiş olup, önbellekten okuma milyon token başına 0,25 ABD dolarıdır - bu, Claude Fable 5'ten girişte yaklaşık beş kat ve çıkışta 8,3 kat daha ucuzdur. Ancak model ayrıntılıdır: tam bir Zeka Endeksi çalışmasında yaklaşık 150 milyon token üretmiş olup, karşılaştırılabilir modellerin medyanının (66 milyon) yaklaşık 2,3 katıdır. Hız saniyede yaklaşık 82 çıkış tokenıdır ve ilk token gecikmesi yaklaşık 2,8 saniyedir. 10 Ağustos sabahı itibarıyla Qwen3.8 Max ve Qwen3.8-27B için açık kaynak ağırlıkları henüz yayınlanmamıştı; ancak Alibaba bunların 3 Ağustos haftasında görüneceğini vaat etti. Büyük model, BF16'da yaklaşık 4,8 TB veya 4 bit'te 1,2 TB gerektirdiğinden, yerel dağıtım çoğu kişi için pratik değildir. Makale, Qwen3.8 Max'ın aracı kodlama, uzun belge analizi, çok adımlı süreçler ve Claude'a yedek olarak uygun olduğunu, ancak geçiş yapmadan önce kişinin kendi görevlerinde test edilmesini öneriyor.
Kaynak: Habr — хаб ИИ — orijinal
Bu konudaki önceki yazılarımız ↓
Güncel haberler