ModelAgen 🇨🇳 27.07.2026 06:02

Ant Bailing Rilis Model Hybrid Reasoning Baru Ling-3.0-Flash

Ant Bailing secara resmi merilis model hybrid reasoning asli barunya, Ling-3.0-Flash, yang memiliki total 124 miliar parameter dengan hanya 5,1 miliar yang diaktifkan per komputasi. Model ini menyamai atau melampaui model yang berukuran 2-3 kali lipat dalam tugas penalaran, mengikuti instruksi, dan konteks panjang, serta menawarkan efisiensi yang lebih tinggi. Model ini tersedia di OpenRouter untuk minggu gratis terbatas sebelum dibuka sumbernya (open-source).
Pada 24 Juli, Ant Bailing meluncurkan model Ling-3.0-Flash dengan total parameter 124 miliar dan parameter aktif 5,1 miliar per langkah, mencapai kinerja yang sebanding dengan model 2-3 kali lebih besar sambil mengurangi biaya komputasi. Model ini dirancang untuk aplikasi agen dengan lebih dari 10.000 lingkungan interaksi nyata serta peningkatan kemampuan koreksi diri dan perencanaan jangka panjang. Model ini menggunakan arsitektur attention hybrid dengan rasio 5:1 antara linear attention KDA dan lapisan MLA, serta meningkatkan Lightning Attention menjadi KDA untuk pelacakan status yang lebih baik. Aktivasi ahli per token dikurangi dari 1/32 menjadi 1/64, sehingga meningkatkan efisiensi. Peningkatan rekayasa mencakup caching tingkat kluster untuk mengurangi latensi token pertama sebesar 60-80% dan kerangka kerja kolaborasi multi-agen untuk stabilitas.
Sumber: QbitAI 量子位 — asli
Postingan kami sebelumnya tentang topik ini ↓
Berita terbaru