OpenAIは、ChatGPTに組み込まれた画像生成モデルの新バージョンであるChatGPT Images 2.5をリリースしたことを同社が火曜日に認めた。このアップデートでは、AI 画像ツールの 3 つの永続的な問題点、つまり生成速度、画像全体をスクランブルする小規模な編集の傾向、テキストでの視覚的なアイデアの説明の難しさに焦点を当てています。

OpenAI によると、Images 2.5 は以前のバージョンよりも鮮明なディテール、より自然な照明、豊かなテクスチャを生成し、参照写真から撮影した人物、ペット、物体の類似性をより良く保持しているとのことです。生成は、以前のバージョンの Images 2.0 よりも最大 50% 高速です。 この件の詳細は、AIの最新動向をご覧ください。

要求された内容のみを変更する編集

AI 画像ジェネレーターに関する最も一般的な苦情は、1 つの小さな変更 (背景の変更、テキスト行の修正) を要求すると、全体像が再描画されることが多いということでした。 OpenAIによると、Images 2.5は、長い会話の中で複数回の編集を行った場合でも、ユーザーが要求したものだけを編集し、画像の残りの部分には手を加えないように構築されているという。

モデルへの早期アクセスを受け取った Axios は、元のコンセプトを失うことなく、システムにタトゥーをデザインさせ、メモから修正し、ロゴを数回繰り返すことでこれをテストしました。これは通常、初期の画像モデルを壊す複数ステップのワークフローです。

スケッチ、テンプレート、コメント

このアップデートでは、Sketch と呼ばれる機能が導入されています。これにより、ユーザーは ChatGPT で直接大まかな落書き (部屋のレイアウトや服装の形状) を描き、その絵を最終画像のガイドとして使用できるようになります。会話中に「@Sketch」と入力すると、ツールが表示されます。 OpenAI は、多くの場合、プロンプト テキストの別の段落を書くよりも、ポイントして描画する方が高速かつ正確であると考えています。

OpenAI は、Sketch に加えて、ポスターや商品などの一般的な形式のテンプレート、特定の編集を対象として画像に直接コメントを残す機能、および他の人が自分の写真とリミックスできるように、作品の背後にある正確なプロンプトを共有するオプションを追加しました。

OpenAIの画像担当プロダクトリードであるAdele Li氏は、目標は人々がクリエイティブなプロセスに積極的に参加し続けることであるとAxiosに語った。 「スケッチ ツールとこれらのテンプレートは、人々を受動的な力としてではなく、創作のプロセスにより深く関与させようとする試みのようなものです」とリー氏は語った。

開発者向けの 2 つの新しい API モデル

開発者は、OpenAI API を通じて 2 つの新しいモデルを入手します。 GPT-Image-2.5 Flare は、ソーシャル コンテンツや製品写真などの日常的な大量の生成を目的としており、低遅延を優先しています。 GPT-Image-2.5 Sunburst は、洗練されたキャンペーン作業のための、低速ですがより正確なオプションとして位置付けられています。

この分割は、OpenAI がテキスト モデルを階層化する方法を反映しており、エンジニアリング チームは、一方ではコストと速度、もう一方では出力品質との間でトレードオフを図ることになります。自社製品にイメージ生成を組み込んでいる企業は、Images 2.5 ファミリを離れることなく、2 つのどちらかを選択できるようになりました。

透かしと出所をそのままに

OpenAIによると、新しいモデルでは、AIが生成した画像の識別に役立つC2PAコンテンツ資格情報や目に見えない透かしとともに、以前の画像バージョンで使用されていた安全性チェックが維持されているという。フォトリアリスティックに生成された画像がソーシャル プラットフォーム全体に広がるにつれて、出所基準の重要性がますます高まっており、OpenAI は合成メディアを検出可能にするよう規制当局や権利所有者からの継続的な圧力に直面しています。

競争が激しく混雑した分野

この発表は、ますます混雑する画像生成市場に上陸します。 TechRepublic は、Canva が 2026 年にクリエイティブ ワークフローの摩擦をターゲットとした 100 以上の Visual Suite アップデートをリリースした一方、Google や xAI などのライバルは独自の画像モデルを繰り返し開発していると指摘しています。今年初めのアリーナランキングでは、OpenAI の GPT-Image-2 と xAI の Imagine がヒューマンプリファレンス リーダーボードのトップ付近に位置していることが示されました。

OpenAI の場合、Images 2.5 の戦略は、生のベンチマーク スコアではなく、使用可能な結果を​​得るために必要なプロンプトの書き換えの数を減らすというインタラクション デザインに重点を置いています。 TechRepublic が述べているように、このアップデートの目的は、AI 画像生成を箱に魔法の呪文を入力するような感覚ではなく、実際に何かを作るような感覚にすることです。

可用性

OpenAIによると、ChatGPT Images 2.5はデスクトップ、モバイル、Web上のすべてのChatGPT、ChatGPT Work、Codexユーザーに展開されるという。 Flare および Sunburst API モデルは開発者がすぐに利用でき、価格の詳細は OpenAI のモデル ドキュメント ページに記載されています。

中小企業やクリエイターにとって、実際的な重要性は明白です。ラベル、手、または背景を修正するための再生成が少なくなるということは、AI 画像ツールが最も頻繁に使用されるチラシ、製品ショット、ソーシャル投稿の処理時間が短縮されることを意味します。 TechRepublic の評価では、このアップデートは、まともなチラシや製品ショットを作成するためだけに即時エンジニアリングの専門家になりたくない人々を直接ターゲットとして、使用可能な結果を​​得るまでのスキルの最低点が引き下げられています。長い形式のプロンプトではなく、Sketch とコメントベースの編集が画像モデルを指示するデフォルトの方法になるかどうかが、今後数か月間注目される指標となるでしょう。

---

AIの最新情報をお届け

AIの最新ニュース、分析、ブレイクスルーを一箇所で。

AIニュースをもっと読む →