ModelSumber Terbuka 🇨🇳 28.07.2026 00:03

Alibaba Merilis Seri Qwen3 Embedding untuk Embedding Teks dan Pemeringkatan

Alibaba/QwenAlibaba/Qwen
Alibaba telah memperkenalkan Qwen3 Embedding, sebuah keluarga baru model proprietary untuk embedding teks, pencarian, dan pemeringkatan, yang dibangun di atas fondasi Qwen3. Model-model ini mencapai kualitas terdepan pada tolok ukur, mendukung lebih dari 100 bahasa, dan dirilis di bawah lisensi Apache 2.0.
Alibaba telah merilis Qwen3 Embedding series — model milik baru dari keluarga Qwen, yang dirancang untuk embedding teks, pencarian, dan peringkat. Model-model ini didasarkan pada model fundamental Qwen3, yang memberi mereka kemampuan multibahasa. Seri ini mencakup tiga ukuran model embedding (0,6B, 4B, 8B) dan tiga model peringkat (0,6B, 4B, 8B). Model embedding mendukung dimensi vektor kustom (Matryoshka Representation Learning, MRL) dan instruksi. Model-model ini dirilis sebagai sumber terbuka di bawah lisensi Apache 2.0 di Hugging Face dan ModelScope; laporan teknis dan kode dipublikasikan di GitHub. Arsitektur model embedding adalah dual-encoder, dan model peringkat adalah cross-encoder. Pelatihan dilakukan dalam beberapa tahap: untuk model embedding — pra-pelatihan kontrastif pada data berlabel lemah, diikuti dengan pelatihan pada data berlabel berkualitas tinggi dan penggabungan model; untuk model peringkat — pelatihan langsung pada data berlabel. Kemampuan generatif Qwen3 digunakan untuk menghasilkan pasangan berlabel lemah selama fase pra-pelatihan. Ke depannya, Alibaba berencana untuk meningkatkan efisiensi pelatihan dan penyebaran, serta memperluas keluarga ini ke representasi multimodal.
Sumber: Alibaba Qwen — asli
Postingan kami sebelumnya tentang topik ini ↓
Berita terbaru