
이미지: The Decoder
요약
- xAI가 Grok에 새 이미지 생성 모델 Imagine Image 2.0을 '퀄리티 모드'로 출시했다
- Arena 벤치마크에서 이미지 편집·텍스트-이미지 두 카테고리 모두 전체 2위를 기록했으며 오픈AI GPT-Image-2에 근소하게 뒤졌다
- Magic Wand, Multi-Ref Editing, Smart Resize 등 편집 도구와 사전 구성 템플릿이 함께 제공된다
- 출시 경로
- grok.com/imagine 및 Grok iOS·Android 앱 내 '퀄리티 모드'
- API 지원
- 곧 제공 예정(xAI 발표 기준)
- Image Edit Arena Elo
- Imagine 2.0(low) 1,439 vs GPT-Image-2 1,463
- Text-to-Image Arena Elo
- Imagine 2.0(low) 1,320 vs GPT-Image-2 1,380
- 전체 순위
- 두 카테고리 모두 전체 2위, Reve 2.1·Muse-Image·Qwen-Image-3.0-Pro·Gemini·SeedDream보다 상위
- 편집 기능
- Magic Wand, 세그멘테이션, 배경 제거, Multi-Ref Editing(최대 5장), Smart Resize
- 템플릿 분야
- 사진 편집, 제품 촬영, 마케팅 소재, 디자인 도구, 게임 에셋, 스트리밍 이모지
출시 개요
xAI가 Grok 플랫폼에 새로운 이미지 생성 모델 Imagine Image 2.0을 공개했다. 이 모델은 grok.com/imagine과 Grok의 iOS·Android 앱에서 새로운 '퀄리티 모드'로 제공되며, API 접근은 곧 지원될 예정이라고 xAI는 밝혔다. 회사는 이 모델이 세밀한 지시 사항을 정확히 따르고, 복잡한 이미지에서도 타이포그래피와 레이아웃을 깔끔하게 유지하며, 여러 번 생성해도 일관성을 유지하도록 설계됐다고 설명했다.
Arena 벤치마크 성적
2026년 8월 7일 기준 Arena 리더보드에서 Imagine 2.0의 더 빠른 'low' 버전은 이미지 편집과 텍스트-이미지 두 카테고리 모두 전체 2위에 올랐다. 이미지 편집 아레나(Image Edit Arena)에서는 Elo 1,439점을 기록해 오픈AI(OpenAI) GPT-Image-2의 1,463점에 근소하게 뒤졌다. 텍스트-이미지 아레나(Text-to-Image Arena)에서도 1,320점으로 GPT-Image-2의 1,380점에 밀렸다.
| 모델 | Image Edit Arena Elo | Text-to-Image Arena Elo |
|---|---|---|
| GPT-Image-2 (OpenAI) | 1,463 bar:100 | 1,380 bar:100 |
| Imagine 2.0 low (xAI) | 1,439 bar:98 | 1,320 bar:96 |
Reve 2.1, 메타(Meta)의 Muse-Image, 알리바바(Alibaba)의 Qwen-Image-3.0-Pro, 구글(Google)의 Gemini, 바이트댄스(ByteDance)의 SeedDream 등은 두 카테고리 모두에서 Imagine 2.0보다 낮은 순위에 머물렀다. 이번 모델은 전작의 '퀄리티' 버전을 큰 차이로 앞섰다고 xAI는 전했다.
새로운 편집 도구
Imagine Image 2.0에는 반복 작업에 최적화된 여러 편집 기능이 추가됐다. 'Magic Wand'는 선택한 영역만 수정하는 기능이며, 세그멘테이션 기능은 정밀한 영역 선택을 지원한다. 배경 제거 도구는 투명 배경으로 대상을 추출해 낼 수 있다.
'Multi-Ref Editing'은 최대 5장의 입력 이미지를 하나의 결과물로 조합하는 기능이다. 'Smart Resize'는 기존 이미지를 원하는 화면 비율로 변환하면서 모델이 여백을 자동으로 채워준다.
관련해 오픈AI의 이미지 생성 모델 흐름을 다룬 메탈랩 기사에서도 최근 이미지 생성 경쟁 구도 변화를 확인할 수 있다.
템플릿과 영상 사전 제작 기능
xAI는 자주 쓰이는 이미지 작업 흐름을 미리 구성한 템플릿도 함께 선보였다. 사진 편집, 제품 촬영, 마케팅 소재, 디자인 도구, 게임 에셋, 스트리밍 이모지 등 여러 분야를 아우른다.
또한 캐릭터, 장소, 소품을 각각 생성하면서도 이미지 전체의 시각적 스타일을 일관되게 유지하는 기능도 공개됐다. xAI는 이를 향후 완전한 영상 제작 워크플로로 가는 발판으로 자리매김하고 있다고 밝혔다. 회사는 이 기능이 영상 제작을 위한 시작점 역할을 할 수 있는 '일관된 시각적 세계'를 만들어낸다고 설명했다.
전망
Imagine 2.0이 GPT-Image-2에 근소하게 뒤진 벤치마크 결과는 이미지 생성 모델 경쟁이 상위권에서 초박빙으로 좁혀지고 있음을 보여준다. API 공개 시점과 향후 영상 생성 기능으로의 확장 여부가 다음 관전 포인트로 꼽힌다.

