Z.ai выпускает GLM-5.3 без переобучения базовой модели: лучше в сложном кодинге и длительных задачах
Компания Z.ai выпустила GLM-5.3, которая работает на той же базовой модели 743B, что и GLM-5.2. Все улучшения достигаются за счет масштабированного пост-обучения: бенчмарки по кодингу, такие как Terminal-Bench 3.0, выросли с 4.6 до 28.3, а показатели кибербезопасности достигли 84.5% на CyberGym. Веса пока не опубликованы, но модель доступна через API и Coding Plan, ожидается публикация весов примерно через две недели.
Z.ai представила модель GLM-5.3, построенную на той же базовой модели объемом 743 млрд параметров, что и GLM-5.2. Все заявленные улучшения достигнуты за счет масштабированного дообучения на большем количестве рабочих окружений, более разнообразных типов окружений и увеличенном сроке обучения. Модель показала существенный рост результатов в бенчмарках долгосрочного программирования: Terminal-Bench
Показать ещё ↓
Источник: MarkTechPost —
оригинал
