Turbo Cloud công bố kết quả đầu tiên của các mô hình AI mới: ngữ cảnh triệu token và 753 tỷ tham số
DeepSeek
Alibaba/Qwen
Nhà cung cấp đám mây Nga Turbo Cloud, thuộc tập đoàn RTK-DATA, đã mở rộng Foundation Model Hub với các mô hình AI thế hệ mới. Một tuần sau khi phát hành DeepSeek-V4-Flash-0731 và GLM 5.2, công ty ghi nhận sự quan tâm ổn định từ các nhà phát triển và doanh nghiệp. Danh mục cũng bao gồm hai mô hình Qwen đáp ứng nhiều nhu cầu doanh nghiệp.
Nhà cung cấp dịch vụ cloud của Nga Turbo Cloud, thuộc tập đoàn RTK-DATA, đã mở rộng Foundation Model Hub của mình với các mô hình AI thế hệ mới hàng đầu. Một tuần sau khi các mô hình DeepSeek-V4-Flash-0731 và GLM 5.2 xuất hiện trên nền tảng, công ty ghi nhận sự quan tâm ổn định từ các nhà phát triển và người dùng doanh nghiệp. DeepSeek-V4-Flash-0731 nổi bật trong các tác vụ tốn nhiều tài nguyên đòi hỏi tốc độ, độ chính xác và khả năng duy trì ngữ cảnh khổng lồ: cửa sổ ngữ cảnh một triệu token của mô hình này cho phép phân tích các tập tài liệu lớn, kho mã nguồn (code repository) hoặc các cơ sở tri thức không đồng nhất trong một lần xử lý duy nhất, trong khi kiến trúc được cập nhật giúp cải thiện khả năng xử lý văn bản và sinh mã, bao gồm cả các kịch bản agentic (tác tử tự hành) nhiều bước. GLM 5.2 hướng đến các tải công việc kỹ thuật và phân tích phức tạp, từ suy luận và tính toán nhiều bước đến xây dựng các hệ thống agent tự hành; trọng số mở (open weights) khiến mô hình này được ưa chuộng trong các dự án cần tùy biến sâu và có thể kiểm toán. Danh mục cũng bao gồm hai mô hình Qwen: Qwen3.6-35B-A3B với 35 tỷ tham số và cửa sổ ngữ cảnh lên tới 262 nghìn token, có thể xử lý cả văn bản và hình ảnh cho các tác vụ kinh doanh điển hình như tạo nội dung, tìm kiếm trong các cơ sở dữ liệu nội bộ và tự động hóa các công việc thường nhật, cùng với Qwen3.5-122B-A10B với 122 tỷ tham số dành cho các kịch bản doanh nghiệp nặng hơn như xử lý khối lượng lớn tài liệu, phân tích dữ liệu và các trợ lý AI cao cấp. Tất cả các mô hình đều được cung cấp qua một API thống nhất tương thích với OpenAI (OpenAI-compatible API), cho phép chuyển đổi giữa các mô hình mà không cần sửa đổi mã nguồn; việc tích hợp không yêu cầu triển khai hạ tầng GPU riêng, còn khả năng quản lý khóa linh hoạt và các giới hạn tiêu thụ có thể cấu hình (theo ngày, tuần, tháng) giúp các nhóm kiểm soát việc sử dụng tài nguyên. Việc thanh toán theo mô hình trả theo mức sử dụng (pay-as-you-go), chỉ tính phí dựa trên số token thực tế đã được xử lý.
Nguồn: CNews —
bản gốc
