Mô hìnhKinh doanh & Thị trường 🇷🇺 10.08.2026 14:01

Qwen3.8 Max ra mắt: Vượt trội Claude Fable 5 về Chỉ số Tác nhân với giá 6 đô la mỗi triệu token

Alibaba/QwenAlibaba/Qwen AnthropicAnthropic
Alibaba đã phát hành phiên bản cuối cùng của Qwen3.8 Max, một mô hình đa phương thức có 2,4 nghìn tỷ tham số và ngữ cảnh triệu token. Các thử nghiệm độc lập cho thấy nó vượt trội hơn Claude Fable 5 về Chỉ số Tác nhân, và giá API của nó thấp hơn đáng kể so với đối thủ. Tuy nhiên, trọng số mở vẫn đang chờ được công bố.
Alibaba đã chính thức phát hành Qwen3.8 Max, một mô hình hỗn hợp chuyên gia (mixture-of-experts) đa phương thức gốc với 2,4 nghìn tỷ tham số. Mô hình hỗ trợ đầu vào là văn bản, hình ảnh và video, đầu ra là văn bản, với cửa sổ ngữ cảnh lên tới một triệu token (983.000 token đầu vào và 131.000 token đầu ra ở chế độ suy luận - thinking mode). Mô hình có tính năng suy luận lai (hybrid thinking) được bật mặc định, khả năng gọi hàm (function calling) và các công cụ tích hợp sẵn, được quảng bá cho lập trình và các quy trình làm việc tác tử (agentic) chuyên nghiệp. Các bài kiểm tra độc lập của Artificial Analysis cho thấy Qwen3.8 Max đạt 58,1 điểm trong Chỉ số Trí tuệ (Intelligence Index) (so với 62,1 của Claude Fable 5) và 58,4 điểm trong Chỉ số Tác tử (Agentic Index) (so với 56,6 của Claude Fable 5), chỉ có hai chế độ của Claude Opus 5 xếp hạng cao hơn. Mức giá được thiết lập là 2 đô la Mỹ cho mỗi triệu token đầu vào và 6 đô la Mỹ cho mỗi triệu token đầu ra, với mức đọc từ bộ nhớ đệm (cached reads) là 0,25 đô la Mỹ cho mỗi triệu token — rẻ hơn khoảng năm lần so với Claude Fable 5 ở đầu vào và rẻ hơn 8,3 lần ở đầu ra. Tuy nhiên, mô hình này khá dài dòng: nó tạo ra khoảng 150 triệu token trong một lượt chạy đầy đủ Chỉ số Trí tuệ, gấp khoảng 2,3 lần mức trung vị (66 triệu) của các mô hình tương đương. Tốc độ đạt khoảng 82 token đầu ra mỗi giây, với độ trễ token đầu tiên khoảng 2,8 giây. Tính đến sáng ngày 10 tháng 8, các trọng số mở (open weights) của Qwen3.8 Max và Qwen3.8-27B vẫn chưa được công bố, mặc dù Alibaba đã hứa rằng chúng sẽ xuất hiện trong tuần của ngày 3 tháng 8. Mô hình lớn này đòi hỏi khoảng 4,8 TB ở định dạng BF16 hoặc 1,2 TB ở định dạng 4-bit, khiến việc triển khai cục bộ trở nên bất khả thi đối với hầu hết người dùng. Bài viết cho rằng Qwen3.8 Max phù hợp cho việc lập trình tác tử, phân tích tài liệu dài, các quy trình nhiều bước, và có thể dùng như một phương án dự phòng cho Claude, nhưng khuyến nghị nên thử nghiệm trên chính các tác vụ của mình trước khi chuyển đổi.
Nguồn: Habr — хаб ИИ — bản gốc
Bài viết liên quan trước đây ↓
Tin mới