режим Fast mode, который увеличивает скорость до 2.5 раз по сравнению со стандартным режимом, при этом стоимость такого ускорения вдвое выше. OpenAI объясняет снижение цен тем, что модель Sol участвовала в оптимизации собственной производственной системы: она переписывала GPU-ядра, улучшила спекулятивное декодирование на 15%, а также участвовала в мониторинге обучения и вмешивалась при возникновении проблем. В результате этих оптимизаций стоимость обслуживания снизилась на 20%. При этом компания подчеркивает, что процесс по-прежнему контролируется человеком (Human in the Loop) — модель может писать код и проводить эксперименты, но цели, проверка результатов и решение о внедрении остаются за людьми. Снижение цен также затрагивает продукты Codex и ChatGPT Work, а модель для авто-ревью в этих сервисах заменена на GPT-5.6 Luna, что позволит сократить расходы примерно в десять раз. Эти изменения направлены на снижение порога для использования агентных рабочих процессов, делая их более доступными для частого применения.