открытым инструкциям (перенос стиля, изменение объектов, замена фона), многоязычные инструкции (китайский и английский), а также динамическое разрешение с произвольным соотношением сторон. Модель также может выполнять задачи визуального восприятия, такие как предсказание карты глубины, сегментация и обнаружение границ, с помощью команд редактирования. Модель находится на стадии предварительного просмотра и доступна через Qwen Chat. Ограничения включают периодические неточности и несогласованности.