Qwen3.8-27B mã nguồn mở: Chạy tác tử 'cấp Opus' trên GPU tiêu dùng, đánh bại Claude trong nhiều tiêu chuẩn đo lường
Alibaba/Qwen
Anthropic
Qwen3.8-27B của Alibaba đã được chính thức mã nguồn mở, có 27 tỷ tham số, hỗ trợ đa phương thức gốc và lên tới 1 triệu token ngữ cảnh. Mô hình này vượt trội so với Claude Opus 4.6 Max trong một số tiêu chuẩn đo lường kỹ thuật phần mềm và tác tử, cho phép chạy cục bộ trên GPU tiêu dùng cao cấp. Mô hình bao gồm mức độ suy luận có thể điều chỉnh và các tối ưu hóa cho các tác vụ ngữ cảnh dài.
Alibaba đã phát hành mô hình nguồn mở Qwen3.8-27B với 27 tỷ tham số. Trên các tiêu chuẩn chính thức, mô hình này vượt trội hơn Claude Opus 4.6 Max về các tác vụ kỹ thuật phần mềm và tác vụ tương tác (agent), ví dụ dẫn đầu với 8,3 điểm trên SWE-bench Pro và 15,2 điểm trên QwenSWEBench. Trong các bài đánh giá tác vụ tương tác (agent), nó đạt 70,7 điểm trên CoWorkBench so với 68,2 điểm của Opus, và trong các bài kiểm tra hoạt động máy tính và điện thoại đa phương tiện, nó đạt 84,3 điểm trên OSWorld-Verified và 81,9 điểm trên AndroidWorld, so với 72,7 và 62,0 điểm của Opus. Mô hình hỗ trợ hiểu biết đa phương tiện gốc, ngữ cảnh gốc 262 nghìn token có thể mở rộng đến 1 triệu token, và bao gồm tính năng điều chỉnh nỗ lực suy luận (xhigh, medium, low) cùng preserve_thining cho các tác vụ tương tác (agent). Kiến trúc của nó sử dụng 48 lớp chú thích tuyến tính Gated DeltaNet và 16 lớp chú thích đầy đủ, giúp xử lý ngữ cảnh dài. Mô hình tương thích với các thư viện Transformers, vLLM, SGLang và TokenSpeed; các phiên bản lượng hóa có sẵn trên Hugging Face, cho phép triển khai trên các GPU tiêu dùng như RTX 3090/4090 hoặc máy Mac của Apple. Các bài kiểm tra cộng đồng đã chứng minh khả năng lập trình và đa phương tiện của nó, bao gồm sự ổn định đồng thời cao trên NVIDIA GH200 và khả năng xử lý video dài.
Nguồn: QbitAI 量子位 —
bản gốc
