модель поддерживает контекст до 128 тысяч токенов, 92 языка программирования и достигает передовых результатов в бенчмарках генерации, завершения, исправления кода и многоязычных тестах. Версия на 7B превосходит DeepSeek-Coder-V2-Lite и CodeStral-22B в задачах с кодом, а также показывает конкурентоспособные математические результаты на тестах GSM8K и Math. Инструктивно настроенная версия, Qwen2.5-Coder-Instruct, дополнительно улучшает производительность задач и обобщение, преуспевая в многоязычном рассуждении о коде (McEval), рассуждении о коде (CRUXEval) и математическом рассуждении (GSM8K, OlympiadBench). Она также сохраняет сильные общие способности в MMLU, CEval и других бенчмарках. Модели выпускаются под лицензией Apache 2.0. Следующие шаги включают версию на 32B и исследование моделей рассуждений, ориентированных на код.