Grok Imagine Image 2.0: Inzetten op Bewerken, Niet op Genereren
xAI
OpenAI
ByteDance
xAI heeft Imagine Image 2.0 uitgebracht, een beeldgenerator die zich richt op iteratief bewerken in plaats van eenmalige generatie. Het bevat functies zoals regiobewerking, achtergrondverwijdering, ondersteuning voor meerdere referenties en slim formaat wijzigen, met benchmarks die het op de tweede plaats zetten in zowel beeldbewerkings- als tekst-naar-beeld-arena's. Het model is momenteel beschikbaar via de Vercel AI Gateway API tegen lagere kosten dan concurrenten.
xAI heeft Imagine Image 2.0 onthuld en positioneert dit als een hulpmiddel voor echt iteratief beeldwerk, in plaats van alleen maar weer een mooie generatie. Het nieuwe model benadrukt nauwkeurige bewerking met functies zoals Magic Wand voor lokale bewerkingen, segmentatie voor zone-selectie, achtergrondverwijdering met PNG-export en multi-referentiebewerking die tot vijf afbeeldingen ondersteunt. Slimme resize ondersteunt negen beeldverhoudingen en er zijn 15 workflowsjablonen voor typische taken zoals fotobewerking, marketingmateriaal en game-assets. Het model streeft ook naar consistentie in personages en scènes, gericht op videoproductieworkflows. In benchmarks staat het op de tweede plaats in de Image Edit Arena met een Elo van 1439 en in de Text-to-Image Arena met 1320, achter GPT-Image-2. Toegang is momenteel via de Vercel AI Gateway API voor $0,05 per generatie, goedkoper dan Seedream 5 Pro, Nano Banano 2 en GPT Image 2, maar langzamer dan Nano Banano 2 en sneller dan GPT Image 2. De auteur merkt op dat Chinese modellen achterblijven bij Nano Banano 2, maar dat dit betaalbare en hoogwaardige model waarschijnlijk een basislijn voor velen zal worden, ook al werken niet alle API-functies momenteel. In Rusland is het model nog niet beschikbaar, behalve via onofficiële toegang tot de preview op Vercel AI Gateway, maar de release is op handen, met beschikbaarheid op verschillende diensten, waaronder VEGA, deze week.
Bron: Habr — хаб ИИ —
origineel
