Mô hìnhTác tử 🇨🇳 12.08.2026 13:04

Kiểm định độc lập: Kimi K3 vượt trội GPT-5.6 Sol trong các tình huống tác tử

Moonshot AIMoonshot AI OpenAIOpenAI
Kết quả kiểm định độc lập từ bên thứ ba cho thấy mô hình Kimi K3 của Moonshot AI vượt trội hơn GPT-5.6 Sol trong các tình huống tác tử, đánh dấu một sự thay đổi cạnh tranh đáng kể. Đánh giá tập trung vào việc thực hiện các tác vụ trong thế giới thực, nơi Kimi K3 thể hiện khả năng lập kế hoạch, sử dụng công cụ và ra quyết định thích ứng vượt trội so với đối thủ.
Theo một báo cáo từ QQ News, các đánh giá độc lập do bên thứ ba thực hiện cho thấy trong các tình huống dạng tác tử (agent), mô hình Kimi K3 của Moonshot AI vượt trội hơn GPT-5.6 Sol của OpenAI. Các bài kiểm tra được thiết kế nhằm so sánh khả năng của các mô hình trong việc xử lý những tác vụ phức tạp, gồm nhiều bước, đòi hỏi khả năng tự lập kế hoạch, lựa chọn công cụ và thích ứng linh hoạt theo tình huống. Kết quả cho thấy Kimi K3 đạt tỷ lệ thành công cao hơn và hoàn thành nhiệm vụ hiệu quả hơn so với GPT-5.6 Sol, qua đó cho thấy một bước tiến đáng kể về năng lực của trí tuệ nhân tạo (AI) dạng tác tử. Kết quả này cũng làm nổi bật sức cạnh tranh ngày càng lớn của các mô hình AI Trung Quốc trên thị trường toàn cầu, đặc biệt trong những ứng dụng thực tiễn, hướng đến hành động.
Nguồn: Moonshot Kimi (GNews) — bản gốc
Bài viết liên quan trước đây ↓
Tin mới