Qwen3.8 Max Dirilis: Mengungguli Claude Fable 5 dalam Indeks Agen dengan Harga $6 per Juta Token
Alibaba/Qwen
Anthropic
Alibaba telah merilis versi final dari Qwen3.8 Max, sebuah model multimodal dengan 2,4 triliun parameter dan konteks satu juta token. Pengujian independen menunjukkan bahwa model ini melampaui Claude Fable 5 dalam Indeks Agen (Agentic Index), dan harga API-nya jauh lebih rendah dibandingkan kompetitor. Namun, bobot terbuka (open weights) masih belum tersedia.
Alibaba telah resmi merilis Qwen3.8 Max, model mixture-of-experts multimodal asli dengan 2,4 triliun parameter. Model ini mendukung input teks, gambar, dan video, serta menghasilkan output teks, dengan jendela konteks hingga satu juta token (983.000 token input dan 131.000 token output dalam mode berpikir). Model ini memiliki fitur berpikir hibrida yang aktif secara default, pemanggilan fungsi, dan alat bawaan, serta dipromosikan untuk pemrograman dan alur kerja agen profesional. Pengujian independen oleh Artificial Analysis menunjukkan Qwen3.8 Max mendapat skor 58,1 dalam Indeks Intelijen (dibandingkan 62,1 untuk Claude Fable 5) dan 58,4 dalam Indeks Agen (dibandingkan 56,6 untuk Claude Fable 5), dengan hanya dua mode Claude Opus 5 yang berada di peringkat lebih tinggi. Harga ditetapkan sebesar $2 per juta token input dan $6 per juta token output, dengan pembacaan cache sebesar $0,25 per juta token - sekitar lima kali lebih murah daripada Claude Fable 5 untuk input dan 8,3 kali lebih murah untuk output. Namun, model ini cenderung bertele-tele: model ini menghasilkan sekitar 150 juta token dalam satu kali menjalankan Indeks Intelijen penuh, sekitar 2,3 kali median (66 juta) dari model sebanding. Kecepatan sekitar 82 token output per detik, dengan latensi token pertama sekitar 2,8 detik. Hingga pagi hari tanggal 10 Agustus, bobot terbuka untuk Qwen3.8 Max dan Qwen3.8-27B belum dipublikasikan, meskipun Alibaba berjanji akan muncul pada minggu tanggal 3 Agustus. Model besar ini membutuhkan sekitar 4,8 TB dalam BF16 atau 1,2 TB dalam 4-bit, sehingga penerapan lokal tidak praktis bagi sebagian besar pengguna. Artikel tersebut menyarankan bahwa Qwen3.8 Max cocok untuk pengkodean agen, analisis dokumen panjang, proses multi-langkah, dan sebagai cadangan untuk Claude, tetapi merekomendasikan untuk mengujinya pada tugas sendiri sebelum beralih.
Sumber: Habr — хаб ИИ —
asli
