模型媒体生成 🇨🇳 27.07.2026 17:05

Qwen-Image:具备精确文字渲染能力的图像生成模型

Alibaba/QwenAlibaba/Qwen
阿里巴巴发布了Qwen-Image,一个200亿参数的基础图像生成模型。它在复杂文字渲染方面优于竞争对手,包括多行字幕和中文汉字,并支持精确的图像编辑。
阿里巴巴(通过其 Qwen 团队)发布了 Qwen-Image——一款基于 MMDiT 架构、拥有 200 亿参数的基础图像生成模型。其核心能力包括:卓越的文字渲染(支持多行布局、段落、字母语言和语标语言)、保持语义与真实感的一致性图像编辑,以及在公开基准测试(GenEval、DPG、OneIG-Bench、GEdit、ImgEdit、GSO、LongText-Bench、ChineseWord、TextCraft)中的强劲表现——该模型超越了现有同类产品。演示案例展示了精准生成中文汉字(出现在招牌、卷轴、书籍、海报等场景中)以及英文文本(包括在狭小空间内呈现的长篇幅内容)的实例。该模型支持海报与演示文稿创作、多种艺术风格适配,以及编辑操作(风格化、添加/移除对象、修改文字与姿态)。
来源: Alibaba Qwen — 原文
我们之前关于此话题的帖子 ↓
最新新闻