Sumber TerbukaModel 🇨🇳 28.07.2026 16:03

Alibaba Merilis Sumber Terbuka Qwen2.5-1M dengan Dukungan Konteks hingga 1 Juta Token

Alibaba/QwenAlibaba/Qwen
Alibaba merilis model terbuka Qwen2.5-7B-Instruct-1M dan Qwen2.5-14B-Instruct-1M dengan konteks hingga 1 juta token, serta kerangka kerja inferensi yang dioptimalkan berbasis vLLM. Model-model ini mengungguli versi sebelumnya dan GPT-4o-mini dalam tugas dengan konteks panjang, sambil mempertahankan performa pada teks pendek.
Alibaba Qwen merilis model open-source Qwen2.5-7B-Instruct-1M dan Qwen2.5-14B-Instruct-1M yang mampu memproses konteks hingga 1 juta token. Untuk penerapannya, perusahaan sepenuhnya membuka framework inferensi berbasis vLLM yang menggunakan sparse attention dan mempercepat pemrosesan 1 juta token hingga 3–7 kali lipat. Model-model ini dilatih secara progresif: pertama pada urutan hingga 256.000 token, kemudian diperluas hingga 1 juta dengan ekstrapolasi panjang (Dual Chunk Attention). Dalam uji pengambilan kata sandi (Passkey Retrieval) dan tugas kompleks (RULER, LV-Eval, LongBench), model-model ini secara signifikan mengungguli versi 128.000 token dan GPT-4o-mini. Untuk inferensi, direkomendasikan GPU dengan arsitektur Ampere atau Hopper, minimal 120 GB VRAM untuk 7B dan 320 GB untuk 14B. Juga diperkenalkan Qwen Chat, asisten AI dengan dukungan konteks panjang.
Sumber: Alibaba Qwen — asli
Postingan kami sebelumnya tentang topik ini ↓
Berita terbaru