GPT-5.6 оптимизирует сам себя: появился новый подход к загрузке
OpenAI
Технический отчёт OpenAI раскрывает, что GPT-5.6 теперь применяется в продакшене для оптимизации собственной среды выполнения, включая анализ трафика, настройку маршрутизации запросов, переписывание низкоуровневых ядер и оптимизацию спекулятивного декодирования. Эти улучшения позволили снизить стоимость обслуживания на 20% и повысить эффективность генерации токенов более чем на 15%. При этом сохраняется человеческий контроль — цели оптимизации и решения о развёртывании управляются людьми.
OpenAI опубликовала технический отчет, в котором подробно описывается RSI (рекурсивное самоулучшение), примененное к GPT-5.6. Модель уже развернута в продакшене: она анализирует трафик, настраивает маршрутизацию, переписывает ядра Triton и Gluon, оптимизирует собственную систему спекулятивного декодирования, проводя сотни экспериментов, и ищет оптимальные параметры развертывания (пакетирование,
Показать ещё ↓
Источник: QbitAI 量子位 —
оригинал
