模型媒体生成 🇷🇺 11.08.2026 11:03

Grok Imagine Image 2.0:押注编辑,而非生成

xAIxAI OpenAIOpenAI ByteDanceByteDance
xAI 发布了 Imagine Image 2.0,这是一款专注于迭代编辑而非一次性生成的图像生成器。它包含区域编辑、背景移除、多参考支持和智能调整大小等功能,基准测试显示其在图像编辑和文本到图像领域均排名第二。该模型目前通过 Vercel AI Gateway API 提供,成本低于竞争对手。
xAI推出了Imagine Image 2.0,将其定位为用于真实迭代图像工作的工具,而非仅仅是另一款生成精美图片的模型。新模型强调精确编辑,具备Magic Wand进行局部编辑、分割选择区域、背景移除并支持PNG导出,以及支持最多五张图片的多参考编辑。智能调整大小支持九种纵横比,并提供15个工作流模板,涵盖照片编辑、营销素材和游戏素材等常见任务。该模型还旨在实现角色和场景的一致性,针对视频制作工作流。在基准测试中,它在Image Edit Arena中以1439的Elo排名第二,在Text-to-Image Arena中以1320排名第二,落后于GPT-Image-2。目前可通过Vercel AI Gateway API访问,每次生成费用为0.05美元,比Seedream 5 Pro、Nano Banano 2和GPT Image 2更便宜,尽管速度比Nano Banano 2慢,但比GPT Image 2快。作者指出,尽管中国模型落后于Nano Banano 2,但这款价格合理且高质量的模型很可能会成为许多人的基准,即使目前并非所有API功能都能正常工作。在俄罗斯,该模型尚不可用,只能通过Vercel AI Gateway上的非官方预览访问,但正式发布在即,本周内将在包括VEGA在内的多个服务上提供。
来源: Habr — хаб ИИ — 原文
我们之前关于此话题的帖子 ↓
最新新闻