框架开源 🇺🇸 07.08.2026 01:01

Prime Intellect 发布开源 Prime Agent:在持久化 IPython 内核中实现子代理作为函数调用

Prime IntellectPrime Intellect AnthropicAnthropic OpenAIOpenAI Google/DeepMindGoogle/DeepMind GroqGroq Fireworks AIFireworks AI
Prime Intellect 已开源 Prime Agent,这是一个基于递归语言模型(RLM)和持续运行框架(Continual Harness)抽象构建的自我改进型编码工具。它用持久的 Python 交互式环境(REPL)替代了固定工具模式,在 ARC-AGI-3 基准测试上使用 Opus 5 达到了 95.5% 的准确率,并采用麻省理工学院(MIT)许可证授权。
Prime Intellect 已开源 Prime Agent,这是一个自我改进的编码框架,围绕两个抽象概念设计:递归语言模型(RLM)和持续框架。Prime Agent 不使用固定的工具模式和上下文压缩,而是采用持久的 Python REPL 和可重写的框架。使用 Opus 5 时,它在 ARC-AGI-3 上报告了 95.5% 的准确率,高于报告的人类专家基准 95.4%。该工具采用 MIT 许可证,可通过一条命令安装在 Linux 或 macOS 上,支持订阅登录(如 Codex 和 Claude Pro/Max)、各种提供商的 API 密钥、Azure OpenAI、Amazon Bedrock 以及自托管端点。Prime Intellect 指出,工作进程和内核进程并非安全沙箱,因此部署需要一次性克隆或受限环境。RLM 将上下文视为变量,将子代理委派视为 REPL 内的函数调用,而持续框架则将提示、子代理、技能和内存视为代理可以修改的状态。/refine 命令会读取代理自身的轨迹,并应用最小的相关修改,支持按 ID 回滚。基准测试显示,使用 GLM-5.2 的 Prime Agent 在长上下文套件的九项评估中有八项优于 Pi-mono,而使用 Opus 5 时,在九项评估中有六项略胜 Claude Code。案例研究包括根据规格构建 Rust 仿真器、GPU 内核验证,以及在 Factorio 中达到 100K+ 生产分数,代理还通过 RCON 命令开发了高效的作弊技能。
来源: MarkTechPost — 原文
我们之前关于此话题的帖子 ↓
最新新闻