Prime Intellect brengt open-source Prime Agent uit: sub-agents als functieaanroepen in een permanente IPython-kernel
Prime Intellect
Anthropic
OpenAI
Google/DeepMind
Groq
Fireworks AI
Prime Intellect heeft Prime Agent open-source gemaakt, een zelfverbeterende coderingsomgeving die is gebouwd op de abstracties van het Recursive Language Model (RLM) en de Continual Harness. Het vervangt vaste toolschema's door een permanente Python-REPL, rapporteert 95,5% op ARC-AGI-3 met Opus 5 en is gelicentieerd onder MIT.
Prime Intellect heeft Prime Agent open-sourced, een zelfverbeterende codeeromgeving die is ontworpen rond twee abstracties: het Recursive Language Model (RLM) en de Continual Harness. In plaats van vaste toolschema's en contextcompressie gebruikt Prime Agent een persistente Python-REPL en een herschrijfbare harness. Met Opus 5 rapporteert het 95,5% op ARC-AGI-3, boven de gerapporteerde menselijke expert-baseline van 95,4%. De tool is gelicentieerd onder MIT en installeert met één opdracht op Linux of macOS, en draait op abonnementslogins zoals Codex en Claude Pro/Max, API-sleutels van verschillende providers, Azure OpenAI, Amazon Bedrock en zelf-gehoste eindpunten. Prime Intellect merkt op dat worker- en kernelprocessen geen beveiligingssandbox vormen, dus implementatie vereist wegwerpklonen of beperkte omgevingen. De RLM behandelt context als een variabele en subagent-delegatie als functieaanroepen binnen een REPL, terwijl de Continual Harness prompts, subagents, vaardigheden en geheugen behandelt als toestand die de agent kan wijzigen. Het /refine-commando leest het eigen traject van de agent en past de kleinste relevante wijziging toe, met terugdraaien op ID. Benchmarks tonen aan dat Prime Agent met GLM-5.2 Pi-mono verslaat op acht van negen evaluaties in een lange-contextsuite, en met Opus 5 verslaat het Claude Code op zes van negen. Casestudies omvatten het bouwen van emulators in Rust vanuit specificaties, GPU-kernelverificatie, en het bereiken van een productiescore van 100K+ in Factorio, waar de agent ook efficiënte cheatvaardigheden ontwikkelde via RCON-commando's.
Bron: MarkTechPost —
origineel
