ModellerAjanlar 🇨🇳 27.07.2026 06:02

Ant Bailing Yeni Hibrit Akıl Yürütme Modeli Ling-3.0-Flash'i Yayınladı

Ant Bailing, resmi olarak yeni yerel hibrit akıl yürütme modeli Ling-3.0-Flash'i yayınladı. Model, toplam 124B parametreye sahip olup her hesaplamada yalnızca 5.1B parametre aktifleştiriliyor. Model, akıl yürütme, talimat takibi ve uzun bağlam görevlerinde kendisinden 2-3 kat büyük modellerle eşleşiyor veya onları geçiyor ve daha yüksek verimlilik sunuyor. Model, açık kaynak haline getirilmeden önce sınırlı bir ücretsiz hafta boyunca OpenRouter'da kullanıma sunuldu.
24 Temmuz'da Ant Bailing, toplam 124 milyar parametre ve adım başına 5,1 milyar aktif parametreye sahip Ling-3.0-Flash modelini piyasaya sürdü. Bu model, 2-3 kat daha büyük modellere benzer performans sunarken hesaplama maliyetlerini düşürüyor. Model, 10.000'den fazla gerçek etkileşim ortamına sahip ajan uygulamaları için tasarlanmış olup, gelişmiş kendi kendini düzeltme ve uzun vadeli planlama özelliklerine sahiptir. Model, KDA doğrusal dikkat ve MLA katmanları arasında 5:1 oranına sahip hibrit bir dikkat mimarisi kullanır ve durum takibini iyileştirmek için Lightning Attention'ı KDA'ya yükseltir. Token başına uzman aktivasyonu 1/32'den 1/64'e düşürülerek verimlilik artırılmıştır. Mühendislik iyileştirmeleri arasında, ilk token gecikmesini %60-80 oranında azaltan küme düzeyinde önbellekleme ve istikrar için çoklu ajan iş birliği çerçevesi yer alıyor.
Kaynak: QbitAI 量子位 — orijinal
Bu konudaki önceki yazılarımız ↓
Güncel haberler