Alibaba Rilis Qwen3.8-Max dengan 2,4 Triliun Parameter, Akan Buka Sumber Bobot Model
Alibaba/Qwen
Moonshot AI
Alibaba telah meluncurkan Qwen3.8-Max, model bahasa terkuatnya dengan total 2,4 triliun parameter, yang dirancang untuk menyelesaikan tugas kompleks secara mandiri selama berhari-hari. Dalam pengujian, model ini berhasil membuat perangkat lunak, mereproduksi hasil penelitian, dan menjalankan simulasi bisnis e-commerce. Model ini tersedia sekarang, dengan bobot model yang akan dirilis minggu depan.
Tim Qwen dari Alibaba telah memperkenalkan Qwen3.8-Max, sebuah model bahasa yang diskalakan hingga total 2,4 triliun parameter dengan 95 miliar parameter aktif per permintaan, dibangun di atas arsitektur Qwen3.5. Fokusnya adalah pada penyelesaian tugas kompleks secara otonom dalam jangka waktu yang lebih lama. Tiga uji coba pengkodean otonom disajikan sebagai uji stres: model tersebut membangun alat oh-my-cli selama 16 hari, menangani 265 commit, 127 pull request, dan 151 isu tanpa campur tangan manusia; model ini mereproduksi dan meningkatkan hasil dari sebuah makalah penelitian, melampaui metodenya pada AIME24 sebesar 2,7 poin; dan model ini menempati posisi di depan 458 dari 526 tim manusia dalam tantangan multimodal. Selain itu, model ini merancang sebuah chip, mengurangi gerbang logika dari 8.298 menjadi 678 dan luas chip sebesar 81%, dan mensimulasikan satu tahun e-commerce, melipatgandakan modal empat kali lipat dan mengungguli GLM 5.2 sebesar 38%. Kemampuan multimodal mencakup pemrosesan dokumen lebih dari 200 halaman dan video lebih dari 100 jam. Performa model ini mendekati atau di atas Claude Opus 4.8, Claude Fable 5, dan GPT-5.6 Sol dalam tolok ukur internal, meskipun verifikasi independen masih tertunda. Bobot (weights) akan dirilis minggu depan di Hugging Face dan ModelScope. Pesaing Moonshot AI merilis Kimi K3 dengan 2,8 triliun parameter dan konteks 1 juta token pada 27 Juli.
Sumber: The Decoder (DE) —
asli
