модель планирует более самостоятельно и выполняет задачи более надёжно. Она изначально обрабатывает до 262 000 токенов контекста, которые можно расширить до одного миллиона токенов с помощью метода YaRN. Помимо текста, модель понимает изображения и видео, такие как диаграммы, документы или видеоролики длительностью в несколько часов. Гибкий режим мышления включён по умолчанию, но его можно отключить для отдельных запросов или настроить глубину. Кроме того, Qwen опубликовала веса для гораздо более крупной модели Qwen3.8-2.4T-A95B, предназначенной для достижения высоких результатов. Обе модели доступны на Hugging Face и ModelScope. Размещённая версия с одним миллионом токенов контекста скоро будет доступна через Qwen Cloud, облачный сервис Alibaba.