ModelSumber Terbuka 🇨🇳 15.08.2026 14:02

Qwen3.8-27B Sumber Terbuka: Menjalankan Agen 'Tingkat Opus' di GPU Konsumen, Mengalahkan Claude dalam Beberapa Tolok Ukur

Alibaba/QwenAlibaba/Qwen AnthropicAnthropic
Qwen3.8-27B dari Alibaba telah resmi dirilis sebagai sumber terbuka, dengan 27 miliar parameter, dukungan multimodal asli, dan hingga 1 juta token konteks. Model ini mengungguli Claude Opus 4.6 Max dalam beberapa tolok ukur rekayasa perangkat lunak dan agen, memungkinkan eksekusi lokal pada GPU konsumen kelas atas. Model ini mencakup upaya penalaran yang dapat disesuaikan dan optimasi untuk tugas konteks panjang.
Alibaba telah merilis model open-source Qwen3.8-27B dengan 27 miliar parameter. Pada tolok ukur resmi, model ini melampaui Claude Opus 4.6 Max dalam tugas rekayasa perangkat lunak dan agen, seperti unggul 8,3 poin pada SWE-bench Pro dan 15,2 poin pada QwenSWEBench. Dalam evaluasi agen, model ini mencetak 70,7 pada CoWorkBench dibandingkan dengan Opus yang mencapai 68,2, dan dalam tes operasi komputer serta ponsel multimodal, model ini mencapai 84,3 pada OSWorld-Verified dan 81,9 pada AndroidWorld, dibandingkan dengan Opus yang masing-masing 72,7 dan 62,0. Model ini mendukung pemahaman multimodal asli, konteks asli 262 ribu token yang dapat diperluas hingga 1 juta, dan mencakup penyesuaian usaha penalaran (xhigh, medium, low) serta preserve_thinking untuk tugas agen. Arsitekturnya menggunakan 48 lapisan perhatian linier Gated DeltaNet dan 16 lapisan perhatian penuh, memungkinkan konteks panjang. Model ini kompatibel dengan Transformers, vLLM, SGLang, dan TokenSpeed, dan versi terkuantisasi tersedia di Hugging Face, sehingga memungkinkan penerapan pada GPU konsumen seperti RTX 3090/4090 atau Mac Apple. Uji komunitas menunjukkan kemampuan pengodean dan multimodalnya, termasuk stabilitas konkurensi tinggi pada NVIDIA GH200 dan pemrosesan video panjang.
Sumber: QbitAI 量子位 — asli
Postingan kami sebelumnya tentang topik ini ↓
Berita terbaru