xAI ra mắt Grok 4.6 với khả năng tác nhân được tăng cường
xAI
Vào ngày 12 tháng 8, xAI đã công bố Grok 4.6, một sự phát triển của mô hình để tăng cường khả năng tác nhân. Mô hình có cửa sổ ngữ cảnh 500.000 token và có sẵn API xAI. Theo xAI, nó đạt 61 điểm trên Chỉ số thông minh Artificial Analysis, ngang bằng với GPT-5.6 Sol.
Sau khi công bố Grok 4.5 vào tháng 7, xAI đã trình làng Grok 4.6 vào ngày 12 tháng 8 – một phiên bản phát triển của mô hình này tập trung cải thiện các khả năng tác tử. Không chỉ đưa ra các phản hồi đơn giản cho truy vấn, mô hình này có thể thực hiện một nhiệm vụ theo thời gian, phân tích thông tin phức tạp, làm việc với cơ sở mã hoặc tạo ra một sản phẩm hoàn chỉnh. Nó được thiết kế để vẫn hoạt động ổn định trong các tác vụ có nhiều bước, như nghiên cứu, phân tích dữ liệu, phát triển phần mềm hoặc tạo tài liệu, nhằm hạn chế việc gián đoạn ngữ cảnh và cho phép AI tiếp tục thực hiện các nhiệm vụ dài mà không cần người dùng điều hướng liên tục. Hướng phát triển này cũng được thể hiện qua các công cụ xung quanh Grok, như Grok Build – một tác tử lập trình hoạt động tương tác hoặc chạy nền. Về mặt kỹ thuật, Grok 4.6 có cửa sổ ngữ cảnh 500.000 token, chấp nhận đầu vào văn bản và hình ảnh, đồng thời tạo ra phản hồi văn bản với các mức độ nỗ lực suy luận có thể cấu hình. Để định vị Grok 4.6 so với các đối thủ cạnh tranh, xAI đề cập đến Chỉ số Trí tuệ Phân tích Trí tuệ (Artificial Analysis Intelligence Index) – một tổng hợp chín chỉ số chuẩn. Theo công ty, Grok 4.6 đạt 61 điểm, vượt qua các mô hình có trọng số mở như Kimi K3 và tiến gần đến các mô hình hàng đầu như GPT-5.6 Sol Max, trong khi Claude Opus 5 và Fable 5 vẫn dẫn đầu trong các đánh giá chuyên ngành. xAI đã đào tạo Grok 4.6 lâu hơn so với Grok 4.5, sử dụng dữ liệu được tạo ra và lựa chọn cho suy luận, kiến thức kỹ thuật và kỹ thuật, được tinh chỉnh bằng học có giám sát và học tăng cường. Mô hình này có sẵn thông qua API của xAI dưới dạng grok-4.6, cũng như trong Cursor và Grok Build.
Nguồn: Le Monde Informatique — IA —
bản gốc
