KhungMã nguồn mở 🇺🇸 07.08.2026 01:01

Prime Intellect phát hành Prime Agent mã nguồn mở: Các tác tử phụ như lời gọi hàm bên trong IPython Kernel liên tục

Prime IntellectPrime Intellect AnthropicAnthropic OpenAIOpenAI Google/DeepMindGoogle/DeepMind GroqGroq Fireworks AIFireworks AI
Prime Intellect đã mã nguồn mở hóa Prime Agent, một bộ khung mã hóa tự cải thiện được xây dựng trên các trừu tượng Recursive Language Model (RLM) và Continual Harness. Nó thay thế các lược đồ công cụ cố định bằng REPL Python liên tục, báo cáo độ chính xác 95,5% trên ARC-AGI-3 với Opus 5, và được cấp phép MIT.
Prime Intellect đã mã nguồn mở Prime Agent, một bộ khung lập trình tự cải thiện được thiết kế dựa trên hai trừu tượng: Mô hình Ngôn ngữ Đệ quy (RLM) và Bộ khung Liên tục. Thay vì các lược đồ công cụ cố định và nén ngữ cảnh, Prime Agent sử dụng một REPL Python liên tục và một bộ khung có thể ghi lại. Với Opus 5, nó đạt 95,5% trên ARC-AGI-3, cao hơn mức cơ sở chuyên gia con người được báo cáo là 95,4%. Công cụ này được cấp phép MIT và có thể cài đặt trên Linux hoặc macOS bằng một lệnh, chạy trên các tài khoản đăng nhập như Codex và Claude Pro/Max, khóa API từ nhiều nhà cung cấp khác nhau, Azure OpenAI, Amazon Bedrock và các điểm cuối tự lưu trữ. Prime Intellect lưu ý rằng các tiến trình worker và kernel không phải là hộp cát bảo mật, vì vậy việc triển khai yêu cầu các bản sao dùng một lần hoặc môi trường hạn chế. RLM coi ngữ cảnh như một biến và việc ủy quyền cho các tác nhân phụ như các lệnh gọi hàm bên trong REPL, trong khi Bộ khung Liên tục coi các lời nhắc, tác nhân phụ, kỹ năng và bộ nhớ như trạng thái mà tác nhân có thể sửa đổi. Lệnh /refine đọc quỹ đạo của chính tác nhân và áp dụng chỉnh sửa nhỏ nhất có liên quan, có thể hoàn tác bằng ID. Các điểm chuẩn cho thấy Prime Agent với GLM-5.2 đánh bại Pi-mono trong tám trên chín bài đánh giá trên bộ dữ liệu ngữ cảnh dài, và với Opus 5, nó vượt qua Claude Code trong sáu trên chín. Các nghiên cứu điển hình bao gồm việc xây dựng trình giả lập trong Rust từ đặc tả, xác minh hạt nhân GPU, và đạt điểm sản xuất 100K+ trong Factorio, nơi tác nhân cũng phát triển các kỹ năng gian lận hiệu quả thông qua lệnh RCON.
Nguồn: MarkTechPost — bản gốc
Bài viết liên quan trước đây ↓
Tin mới