ModellenBedrijf & Markt 🇨🇳 30.07.2026 12:04

GPT-5.6 optimaliseert zichzelf, een nieuwe bootstrap-aanpak is ontstaan

OpenAIOpenAI
Uit het technische rapport van OpenAI blijkt dat GPT-5.6 nu in productie wordt toegepast om zijn eigen runtime-omgeving te optimaliseren, waaronder het analyseren van verkeer, het aanpassen van routering van verzoeken, het herschrijven van low-level kernels en het optimaliseren van speculatieve decodering. Deze verbeteringen hebben de end-to-end servicekosten met 20% verlaagd en de tokengeneratie-efficiëntie met meer dan 15% verhoogd. Ondertussen blijft menselijk toezicht bestaan, waarbij optimalisatiedoelen en implementatiebeslissingen door mensen worden aangestuurd.
OpenAI heeft een technisch rapport gepubliceerd over RSI (Recursieve Zelfverbetering, Recursive Self-Improvement) toegepast op GPT-5.6. Het model is nu in productie ingezet: het analyseert verkeer, past routering aan, herschrijft Triton- en Gluon-kernels, optimaliseert het eigen speculatieve decoderingssysteem door honderden experimenten uit te voeren, en zoekt naar optimale implementatieparameters (batching, sharding, KV-cachebeheer). Als gevolg hiervan daalden de end-to-end servicekosten van OpenAI met 20% en verbeterde de tokengeneratie-efficiëntie met meer dan 15%. Een opvallende auteur is Philippe Tillet, de maker van Triton. Menselijk toezicht blijft echter bestaan: mensen stellen optimalisatiedoelen, toolmachtigingen, evaluatiestatistieken en definitieve implementatiebeslissingen vast. Bovendien bouwde OpenAI een op Rust gebaseerde Agent Harness om repetitieve overhead in agentloops te verminderen, met optimalisaties zoals luie tooldetectie (alleen tools tonen wanneer nodig) en alleen-toevoegen promptcaching om contexthergebruik te behouden. Tijdens interne tests van GPT-5.6 verdubbelde de dagelijkse tokenoutput per actieve onderzoeker in vergelijking met de piek van GPT-5.5; de rekenkracht voor onderzoek naar interne programmeerredenering groeide 100-voudig in zes maanden, en het interne agent-tokengebruik steeg met ongeveer 22 keer.
Bron: QbitAI 量子位 — origineel
Eerdere berichten over dit onderwerp ↓
Vers nieuws