Elon Musk の xAI は、新しい画像ジェネレーターである Imagine Image 2.0 をリリースしました。現在、grok.com/imagine の「品質モード」として、および Grok の iOS および Android アプリ内で利用可能です。 2026 年 8 月 8 日に発表されたこの発表により、xAI は OpenAI および画像モデルの混雑した分野と直接競合することになり、独立したベンチマークによると、xAI はすでにリーダーの後を追いつつあります。モデルのリリースやベンチマークの戦いに関する最新情報については、AI ニュース速報 をフォローしてください。
両アリーナ部門で 2 位
2026 年 8 月 7 日時点の Arena リーダーボードでは、Imagine Image 2.0 のより高速な「低」バージョンが、プラットフォームによって追跡されている両方の画像カテゴリで 世界第 2 位になっています。 Image Edit Arena では、Elo 評価は 1,439 であり、OpenAI の GPT-Image-2 の 1,463 を下回っています。 Text-to-Image Arena では 1,320 に達し、やはり GPT-Image-2 の 1,380 のすぐ後ろにあります。
差は狭いが安定している。 xAI と OpenAI の下には、リーダーボードには有力な候補がひしめいています。Reve 2.1、Meta の Muse-Image、Alibaba の Qwen-Image-3.0-Pro、Google の Gemini、ByteDance の SeedDream はすべて、さらに下位にランクされています。 xAIは、新しいモデルが同じテストで前モデルの「Quality」バージョンを大差で上回り、大幅な世代の飛躍を示唆していると指摘した。
美しい写真だけでなく、正確さを追求して構築
xAI によると、Imagine Image 2.0 は、きめ細かい精度で指示に従い、複雑なビジュアルでもタイポグラフィーとレイアウトをきれいに保ち、複数の世代にわたって視覚的な一貫性を保つように設計されています。これらの目標は、クリエイティブおよび商業ワークフローの実際的な要求を対象としています。そこでは、印象的な画像を生成するものの、テキスト オーバーレイが破損したり、特定の構成指示を無視したりするモデルの用途は限られています。
指示に従うこととタイポグラフィーは、画像生成における重要な戦場となっています。読みやすいテキストを確実にレンダリングし、アスペクト比を尊重し、詳細なプロンプトに従うことができるモデルは、単に見た目は美しいが予測できない出力を生成するモデルよりも、デザイナー、マーケティング担当者、製品チームにとってはるかに価値があります。 xAI は、Imagine 2.0 をその信頼性層に真っ向から位置づけています。
一連の編集ツール
Imagine Image 2.0 には、RAW 生成以外にも、実用的なクリエイティブ作業を目的とした一連の編集機能が付属しています。
- Magic Wand は画像の選択した領域のみを変更し、画像全体を再生成することなく対象を絞った編集を可能にします。
- セグメンテーション機能により、ユーザーは編集する正確な領域を選択でき、背景削除ツールにより、背景が透明な被写体をエクスポートできます。
- Multi-Ref Editing は、最大 5 つの入力イメージを 1 つの世代に結合します。これは、リファレンスをブレンドしたり、バリエーション間でキャラクターを維持したりするのに役立ちます。
- スマート サイズ変更 は、既存の画像を任意のアスペクト比に変換し、モデルが独自に余分なスペースを埋めます。
これらのツールは、ワンショットの生成から、プロのクリエイターが実際に日常的に使用する種類のワークフローである、反復的で制御可能な編集への業界の広範な移行を反映しています。
テンプレートとビデオへの道
xAI は、一般的な画像ワークフローを事前構成された開始点にバンドルする テンプレート も追加しています。カテゴリは、写真編集、製品写真、マーケティング資料、デザイン ツール、ゲーム アセット、ストリーミング絵文字など多岐にわたります。 xAI は、ユーザーに専用のプリセットを提供することで、専門家以外のユーザーがブランドに沿った洗練されたビジュアルを迅速に作成するための障壁を下げています。
おそらく最も将来性のある機能は、すべての画像で視覚スタイルの一貫性を維持しながらキャラクター、場所、小道具を個別に生成する機能です。 xAI は、この一貫性機能を完全なビデオ制作ワークフローへの足がかりとして位置付けています。これは、同社が画像生成をエンドポイントではなく、よりリッチなメディアの基盤として捉えていることを示唆しています。
競争上の賭け金
画像生成市場は、AI の分野で最も激しい競争の 1 つとなっています。現在、OpenAI がトップの座を維持していますが、1 位と 2 位の間の距離は現在、数百ではなく数十の Elo ポイントで測定されています。 Meta、Alibaba、Google、ByteDance がすべて競合モデルを展開しており、xAI がその差を縮めているため、このカテゴリーを永続的に固定できるプロバイダーは 1 つもありません。
特に Grok の場合、強力なイメージ モデルにより、オールインワンの消費者向け AI 製品としての魅力が深まります。 xAI は、Imagine Image 2.0 の API アクセス が「近日中に登場する」と述べ、これによりモデルが開発者や企業に開放されることになり、Grok 独自のアプリ エコシステムを超えて、サードパーティのクリエイティブ ツールへの採用が加速する可能性があります。
何を見るべきか
Arena のランキングはスナップショットであり、画像ベンチマークはプロバイダーが反復するにつれて急速に変化する可能性があります。 Imagine Image 2.0 にとって本当の試練は、その精度、編集、一貫性への重点が、繰り返しの使用を促進するクリエイティブな専門家の間で継続的に採用されるかどうか、そして xAI がその勢いを静止画からすでに伝えているビデオ ワークフローにまで拡張できるかどうかです。
AI の先を行く
画像生成競争は急速に進んでおり、新しいモデルや機能が毎週登場しています。モデルのリリース、ツール、この分野を定義しようと競合している企業に関する明確なベンチマーク主導のレポートについては、当社のホームページをブックマークし、https://aibuzzwire.news で AI ニュースの続きを読む→ してください。
