Nhóm Qwen của Alibaba phát hành các mô hình Qwen3.8 với trọng số mở theo Apache-2.0
Alibaba/Qwen
Nhóm AI Qwen của Alibaba đã phát hành trọng số mô hình mở cho Qwen3.8. Mô hình lõi Qwen3.8-27B là một mô hình đa phương thức dày đặc với 27 tỷ tham số, vượt trội so với Qwen3.7-Plus lớn hơn trong nhiều lĩnh vực, đặc biệt là lập trình và các tác vụ văn phòng. Mô hình xử lý ngữ cảnh lên đến 262.000 token tự nhiên và có thể mở rộng lên một triệu token bằng phương pháp YaRN.
Nhóm AI Qwen của Alibaba đã công bố trọng số mở cho các mô hình Qwen3.8 theo giấy phép Apache-2.0 miễn phí. Mô hình hàng đầu là Qwen3.8-27B, một mô hình đa phương thức dạng dày đặc với 27 tỷ tham số, được cho là vượt trội hơn mô hình lớn hơn Qwen3.7-Plus trong nhiều lĩnh vực, đặc biệt là lập trình và tác vụ văn phòng. Qwen cũng nhấn mạnh khả năng tác nhân (agentic) được cải thiện, với khả năng lập kế hoạch độc lập hơn và hoàn thành tác vụ một cách đáng tin cậy hơn. Mô hình có khả năng xử lý gốc tối đa 262.000 token ngữ cảnh và có thể được mở rộng đến 1 triệu token bằng phương pháp YaRN. Ngoài văn bản, mô hình còn hiểu hình ảnh và video, như sơ đồ, tài liệu hoặc video kéo dài hàng giờ. Chế độ tư duy linh hoạt được bật theo mặc định nhưng có thể bị tắt theo yêu cầu hoặc điều chỉnh mức độ. Ngoài ra, Qwen đã phát hành trọng số cho mô hình lớn hơn nhiều Qwen3.8-2.4T-A95B, được thiết kế để mang lại hiệu năng cao nhất. Cả hai mô hình đều có sẵn trên Hugging Face và ModelScope. Một phiên bản được lưu trữ với ngữ cảnh 1 triệu token sẽ sớm được cung cấp thông qua Qwen Cloud, dịch vụ AI của Alibaba.
Nguồn: The Decoder (DE) —
bản gốc
