Qwen-Image: модель для генерации изображений с точным отображением текста
Alibaba/Qwen
Alibaba выпустила Qwen-Image — фундаментальную модель генерации изображений на 20 миллиардов параметров. Она превосходит конкурентов в сложном рендеринге текста, включая многострочные надписи и иероглифы, а также поддерживает точное редактирование изображений.
Компания Alibaba (через подразделение Qwen) анонсировала Qwen-Image — фундаментальную модель генерации изображений с архитектурой MMDiT и 20 миллиардами параметров. Ключевые возможности включают превосходный рендеринг текста (поддержка многострочных макетов, абзацев, алфавитных и логографических языков), согласованное редактирование изображений с сохранением семантики и реализма, а также сильную
Показать ещё ↓
- Сокращения
- MMDiT = Mixture-of-Multi-Head-DiT — смесь многоголовых DiT
Источник: Alibaba Qwen —
оригинал
