Elon Musk의 xAI는 이제 grok.com/imagine과 Grok의 iOS 및 Android 앱 내에서 "품질 모드"로 사용할 수 있는 새로운 이미지 생성기인 Imagine Image 2.0을 출시했습니다. 2026년 8월 8일에 발표된 이번 출시로 xAI는 OpenAI 및 혼잡한 이미지 모델 분야와 직접 경쟁하게 되었으며, 독립적인 벤치마크에 따르면 이미 선두의 뒤를 바짝 쫓고 있습니다. 최신 모델 출시 및 벤치마크 전투를 보려면 AI 속보를 팔로우하세요.

두 아레나 부문 모두 2위

2026년 8월 7일 현재 아레나 리더보드에서는 Imagine Image 2.0의 더 빠른 "낮은" 변형이 플랫폼에서 추적하는 두 이미지 카테고리 모두에서 전 세계적으로 2위를 차지했습니다. 이미지 편집 아레나에서는 1,439의 Elo 등급을 기록했으며, 1,463으로 OpenAI의 GPT-Image-2에 뒤처졌습니다. Text-to-Image Arena에서는 1,320에 도달하며, 다시 1,380으로 GPT-Image-2 바로 뒤를 따릅니다.

격차는 좁지만 꾸준하다. xAI 및 OpenAI 아래의 리더보드에는 Reve 2.1, Meta의 Muse-Image, Alibaba의 Qwen-Image-3.0-Pro, Google의 Gemini 및 ByteDance의 SeedDream 등 순위가 더 낮은 경쟁자들로 가득합니다. xAI는 새 모델이 동일한 테스트에서 이전 모델의 "품질" 변형을 크게 앞지르며 상당한 세대적 도약을 시사한다고 지적했습니다.

단지 예쁜 그림이 아닌 정밀함을 위해 제작됨

xAI에 따르면 Imagine Image 2.0은 세부적인 정확성으로 지침을 따르고, 복잡한 시각적 요소에서 타이포그래피와 레이아웃을 깔끔하게 유지하며, 여러 세대에 걸쳐 시각적 일관성을 유지하도록 설계되었습니다. 이러한 목표는 눈에 띄는 이미지를 생성하지만 텍스트 오버레이를 엉망으로 만들거나 특정 구성 지침을 무시하는 모델의 사용이 제한되는 창의적이고 상업적인 작업 흐름의 실제 요구를 대상으로 합니다.

지시 따르기 및 타이포그래피는 이미지 생성의 주요 전쟁터가 되었습니다. 읽기 쉬운 텍스트를 안정적으로 렌더링하고, 종횡비를 존중하고, 세부적인 프롬프트를 준수할 수 있는 모델은 단지 미학적으로 만족스럽지만 예측할 수 없는 출력을 생성하는 모델보다 디자이너, 마케팅 담당자 및 제품 팀에게 훨씬 더 가치가 있습니다. xAI는 Imagine 2.0을 해당 신뢰성 계층에 정확하게 배치하고 있습니다.

편집 도구 모음

Raw 생성을 넘어 Imagine Image 2.0은 실용적인 창의적 작업을 목표로 하는 편집 기능 모음을 제공합니다.

  • Magic Wand는 이미지에서 선택한 영역만 수정하므로 전체 사진을 다시 생성하지 않고도 원하는 대로 편집할 수 있습니다.
  • 세분화 기능을 사용하면 사용자가 편집할 정확한 영역을 선택할 수 있으며, 배경 제거 도구를 사용하면 배경이 투명한 피사체를 내보낼 수 있습니다.
  • 다중 참조 편집은 최대 5개의 입력 이미지를 단일 생성으로 결합하여 참조를 혼합하거나 변형 전체에서 문자를 유지하는 데 유용합니다.
  • 스마트 크기 조정은 모델이 자체적으로 추가 공간을 채우면서 기존 이미지를 원하는 가로 세로 비율로 변환합니다.

이러한 도구는 일회성 생성에서 반복적이고 제어 가능한 편집으로의 광범위한 업계 변화를 반영합니다. 이는 전문 크리에이티브가 실제로 매일 사용하는 일종의 워크플로우입니다.

템플릿과 비디오를 향한 길

xAI는 또한 일반적인 이미지 워크플로우를 사전 구성된 시작점에 묶는 템플릿을 추가하고 있습니다. 카테고리에는 사진 편집, 제품 사진, 마케팅 자료, 디자인 도구, 게임 자산, 스트리밍 이모티콘이 포함됩니다. xAI는 사용자에게 특수 제작된 사전 설정을 제공함으로써 비전문가가 세련된 브랜드 비주얼을 신속하게 제작할 수 있는 장벽을 낮추고 있습니다.

아마도 가장 미래 지향적인 기능은 모든 이미지에서 시각적 스타일을 일관되게 유지하면서 **캐릭터, 위치 및 소품을 별도로 생성하는 기능일 것입니다. xAI는 이러한 일관성 기능을 전체 비디오 제작 워크플로우를 향한 디딤돌로 삼고 있습니다. 이는 회사가 이미지 생성을 최종 지점이 아니라 보다 풍부한 미디어를 위한 기반으로 보고 있음을 암시합니다.

경쟁 상황

이미지 생성 시장은 AI 분야에서 가장 치열한 경쟁을 벌이는 분야 중 하나가 되었습니다. 현재 OpenAI가 1위 자리를 차지하고 있지만, 1위와 2위 사이의 거리는 이제 수백 개가 아닌 수십 개의 Elo 포인트로 측정됩니다. Meta, Alibaba, Google 및 ByteDance가 모두 경쟁 모델을 배치하고 xAI가 격차를 좁히면서 단일 제공업체가 해당 카테고리에 대해 영구적인 고정 기능을 갖고 있지 않습니다.

특히 Grok의 경우 강력한 이미지 모델은 올인원 소비자 AI 제품으로서의 매력을 더욱 심화시킵니다. xAI는 Imagine Image 2.0에 대한 API 액세스가 "곧 출시될 예정"이라고 말했습니다. 이를 통해 개발자와 기업에 모델이 공개될 것입니다. 이는 Grok의 자체 앱 생태계를 넘어 타사 크리에이티브 도구로의 채택을 가속화할 수 있는 움직임입니다.

볼만한 동영상

Arena 순위는 스냅샷이며 이미지 벤치마크는 공급자가 반복함에 따라 빠르게 바뀔 수 있습니다. Imagine Image 2.0에 대한 실제 테스트는 정확성, 편집 및 일관성에 대한 강조가 반복 사용을 유도하는 창의적인 전문가들 사이에서 지속적인 채택으로 해석되는지 여부와 xAI가 정지 이미지에서 이미 전해지고 있는 비디오 워크플로로 추진력을 확장할 수 있는지 여부입니다.

AI보다 앞서 나가세요

매주 새로운 모델과 기능이 출시되면서 이미지 생성 경쟁이 빠르게 진행되고 있습니다. 모델 릴리스, 도구, 해당 분야를 정의하기 위해 경쟁하는 회사에 대한 명확한 벤치마크 중심 보고를 받으려면 당사 홈페이지를 북마크에 추가하고 https://aibuzzwire.news에서 더 많은 AI 뉴스를 읽어보세요 →.