Mô hình RSS

Nghiên cứu 🇺🇸

DeepSeek hé lộ mô hình R2 và giới thiệu phương pháp mở rộng suy luận mới SPCT

DeepSeek đã công bố một nghiên cứu đề xuất phương pháp Self-Principled Critique Tuning (SPCT) nhằm cải thiện khả năng mở rộng của các mô hình phần thưởng tổng quát trong quá trình suy luận. Đồng thời, công ty hé lộ về việc sắp ra mắt mô hình tiếp theo, R2, dự kiến dựa trên các phương pháp học tăng cường thuần túy.

DeepSeekDeepSeek OpenAIOpenAI
Synced28.07 · 00:03
Mô hình 🇨🇳

Alibaba Qwen ra mắt Qwen3: tư duy kết hợp, hỗ trợ 119 ngôn ngữ và cạnh tranh với các đối thủ dẫn đầu

Alibaba Qwen đã công bố dòng mô hình Qwen3, bao gồm mô hình chủ lực Qwen3-235B-A22B với 235 tỷ tham số (22 tỷ tham số hoạt động), được so sánh với DeepSeek-R1, o1, o3-mini, Grok-3 và Gemini-2.5-Pro. Các mô hình hỗ trợ chế độ tư duy kết hợp (suy luận và phản hồi nhanh), làm việc với 119 ngôn ngữ, có khả năng tác tử được cải thiện và tích hợp MCP. Trọng số của tám mô hình được phát hành theo giấy phép Apache 2.0.

Alibaba/QwenAlibaba/Qwen
Alibaba Qwen28.07 · 00:03
Tin mới