Tim Qwen dari Alibaba Merilis Model Qwen3.8 dengan Bobot Terbuka di bawah Apache-2.0
Alibaba/Qwen
Tim AI Qwen dari Alibaba telah merilis bobot model terbuka untuk Qwen3.8. Model inti Qwen3.8-27B adalah model padat multimodal dengan 27 miliar parameter yang mengungguli Qwen3.7-Plus yang lebih besar di banyak area, terutama dalam pemrograman dan tugas kantor. Model ini menangani hingga 262.000 token konteks secara asli dan dapat diperluas hingga satu juta token dengan metode YaRN.
Tim AI Alibaba, Qwen, telah merilis bobot terbuka untuk model Qwen3.8 di bawah lisensi gratis Apache-2.0. Model unggulan, Qwen3.8-27B, adalah model multimodal padat dengan 27 miliar parameter yang dikabarkan melampaui Qwen3.7-Plus yang lebih besar dalam banyak domain, terutama pemrograman dan tugas perkantoran. Qwen juga menyoroti kemampuan agen yang lebih baik, dengan model yang merencanakan lebih mandiri dan menyelesaikan tugas dengan lebih andal. Model ini secara native memproses hingga 262.000 token konteks dan dapat diperluas hingga satu juta token menggunakan metode YaRN. Selain teks, model ini memahami gambar dan video, seperti diagram, dokumen, atau video berdurasi berjam-jam. Mode berpikir fleksibel diaktifkan secara default tetapi dapat dinonaktifkan per permintaan atau disesuaikan kedalamannya. Selain itu, Qwen telah merilis bobot untuk model Qwen3.8-2.4T-A95B yang jauh lebih besar, yang ditujukan untuk performa kelas atas. Kedua model tersedia di Hugging Face dan ModelScope. Versi yang dihosting dengan satu juta token konteks akan segera ditawarkan melalui Qwen Cloud, layanan AI Alibaba.
Sumber: The Decoder (DE) —
asli
