모델미디어 생성 🇷🇺 11.08.2026 11:03

Grok Imagine Image 2.0: 편집에 초점을 맞춘 전략

xAIxAI OpenAIOpenAI ByteDanceByteDance
xAI가 일회성 생성보다는 반복적 편집에 초점을 맞춘 이미지 생성기 Imagine Image 2.0을 출시했습니다. 이 모델은 영역 편집, 배경 제거, 다중 참조 지원, 스마트 크기 조정 등의 기능을 포함하며, 벤치마크에서 이미지 편집 및 텍스트-이미지 생성 분야 모두에서 2위를 차지했습니다. 현재 Vercel AI Gateway API를 통해 경쟁사보다 낮은 비용으로 제공됩니다.
xAI가 Imagine Image 2.0을 공개하며, 단순히 또 하나의 아름다운 이미지 생성 도구가 아니라 실질적인 반복 편집 작업을 위한 도구로 자리매김시켰다. 이 신규 모델은 정밀한 편집 기능을 강조하는데, 국소적 편집을 위한 Magic Wand, 영역 선택을 위한 세그멘테이션(segmentation), PNG 내보내기가 가능한 배경 제거, 그리고 최대 5장의 이미지를 지원하는 다중 참조 편집 기능 등을 갖추고 있다. 스마트 리사이즈는 9가지 화면비를 지원하며, 사진 편집·마케팅 소재·게임 에셋 같은 전형적인 작업을 위한 15가지 워크플로 템플릿도 제공된다. 이 모델은 또한 캐릭터와 장면 전반에 걸친 일관성을 목표로 하여 영상 제작 워크플로를 겨냥하고 있다. 벤치마크에서는 Image Edit Arena에서 Elo 1439점으로 2위, Text-to-Image Arena에서는 1320점을 기록해 GPT-Image-2에 뒤이어 2위를 차지했다. 현재는 Vercel AI Gateway API를 통해 생성당 0.05달러로 이용할 수 있으며, 이는 Seedream 5 Pro, Nano Banano 2, GPT Image 2보다 저렴한 가격이다. 다만 속도는 Nano Banano 2보다는 느리지만 GPT Image 2보다는 빠르다. 저자는 중국산 모델들이 여전히 Nano Banano 2에 뒤처지고 있는 가운데, 이처럼 저렴하면서도 고품질인 모델이 현재 일부 API 기능이 작동하지 않음에도 불구하고 많은 이들에게 기준점(baseline)이 될 가능성이 높다고 지적한다. 러시아에서는 아직 정식 출시되지 않았으며, Vercel AI Gateway의 프리뷰 버전에 비공식적으로 접근하는 방법 외에는 이용할 수 없다. 하지만 정식 출시가 임박했으며, 이번 주 중으로 VEGA를 비롯한 여러 서비스에서 이용 가능해질 예정이다.
출처: Habr — хаб ИИ — 원문
관련 게시물 ↓
새로운 뉴스