Mô hìnhTác tử 🇷🇺 13.08.2026 05:02

Grok 4.6 Phát hành: AI Tác tử Nâng cao, Điểm chuẩn Cải thiện, Có sẵn trong Cursor và Grok Build

xAIxAI
xAI đã phát hành Grok 4.6, một phiên bản nâng cấp của mô hình AI tập trung vào các tác tử chạy dài hạn và các nhiệm vụ tương tác và thị giác phức tạp. Mô hình cho thấy hiệu suất cạnh tranh trên một số điểm chuẩn, đôi khi ngang bằng hoặc vượt qua GPT-5.6 Sol và Fable 5. Grok 4.6 có sẵn trong Cursor và Grok Build, với truy cập API và các nền tảng đối tác.
xAI đã ra mắt Grok 4.6, xây dựng trên nền tảng Grok 4.5 với các khả năng nâng cao cho các tác vụ tác nhân chạy dài, cải thiện xử lý các quy trình đa bước phức tạp bao gồm nghiên cứu, viết mã và biến ý tưởng thành các ứng dụng hoàn chỉnh. Mô hình được huấn luyện với một giai đoạn huấn luyện bổ sung kéo dài bằng cách sử dụng dữ liệu do mô hình tạo ra được chọn lọc kỹ càng, trình tối ưu hóa cải tiến và phương pháp cập nhật, sau đó là các giai đoạn SFT (tinh chỉnh có giám sát) và RL (học tăng cường). Mô hình thể hiện khả năng tự kiểm tra và xác minh, đồng thời vượt trội trong việc chuyển đổi ý tưởng sản phẩm thành các nguyên mẫu hoạt động, đặc biệt là trong các dự án trực quan và tương tác. Các cơ chế an toàn đã được nâng cấp và hiệu chỉnh, với mô hình trải qua quá trình thử nghiệm sâu rộng nhất trong lịch sử của xAI. Kết quả điểm chuẩn cho thấy Grok 4.6 High đạt AA Intelligence Index 61, GDPVal-AA v2 1753, CursorBench v3.2 69,9%, DeepSWE v1.1 65,9%, FrontierCode v1.1 (Extended) 61,3%, APEX-Agents 57,5%, Terminal-Bench v3.0 26%, APEX-SWE 56,4%, AA-Briefcase 1577 và Harvey LAB (Vals) 15,8%. Grok 4.6 hiện có sẵn trong Cursor và Grok Build, cũng như qua API và trên các nền tảng đối tác bao gồm OpenRouter, Vercel và Cloudflare. Giá khởi điểm từ 2 đô la cho mỗi triệu token đầu vào và 6 đô la cho mỗi triệu token đầu ra, với phiên bản nhanh hơn có giá gấp đôi. Trong tuần đầu tiên, mức sử dụng bao gồm trong Grok Build và Cursor được tăng gấp đôi.
Nguồn: Habr — хаб ИИ — bản gốc
Bài viết liên quan trước đây ↓
Tin mới