powered by TechFeed
表示モード
主要ニュース

xAIの画像生成AI「Imagine Image 2.0」がユーザー評価で世界2位に — OpenAI GPT-Image-2と20〜60ポイント差、他競合は大きく引き離す

8月8日、The Decoderが「xAI's Imagine Image 2.0 lands just behind OpenAI's GPT-Image-2 in Arena benchmarks」と題した記事を公開した。GPT-Image-2に次ぐ2位——Arenaベンチマークの数字xAIは、画像生成モデルImagine Image 2.0をgrok.com/imagineおよびGrokのiOS/Androidアプリ上の「Quality Mode」として公開した。API提供も近日中に予定されているという。注目はArenaリーダーボード(2026年8月7日時点)における順位だ。

8月8日、The Decoderが「xAI's Imagine Image 2.0 lands just behind OpenAI's GPT-Image-2 in Arena benchmarks」と題した記事を公開した。

GPT-Image-2に次ぐ2位——Arenaベンチマークの数字

xAIは、画像生成モデルImagine Image 2.0grok.com/imagineおよびGrokのiOS/Androidアプリ上の「Quality Mode」として公開した。API提供も近日中に予定されているという。

注目はArenaリーダーボード(2026年8月7日時点)における順位だ。

  • Image Edit Arena:Imagine Image 2.0(lowバリアント)のEloレーティングは1,439。首位のOpenAI GPT-Image-2は1,463
  • Text-to-Image Arena:Imagine Image 2.0は1,320、GPT-Image-2は1,380

両カテゴリでGPT-Image-2に20〜60ポイント差をつけられているものの、その他の競合は大きく引き離している。Reve 2.1、MetaのMuse-Image、AlibabaのQwen-Image-3.0-Pro、GoogleのGemini、ByteDanceのSeedDreamはいずれも下位に留まっている。また、前世代の「Quality」バリアントに対しても大差で上回っており、世代間の性能向上は明確だ。

なお、ここで使われている「Eloレーティング」とは、チェスの棋士ランキングでも使われる相対評価方式で、ユーザーが2つの出力を比較して好みを選ぶことでスコアが決まる。Chatbot Arenaと同様の手法を採用しており、自動評価指標では捉えにくい「人間の好み」を反映しやすい点でエンジニアにも信頼されている評価手法だ。

編集ツール群——反復ワークフロー向けの設計

Imagine Image 2.0には複数の編集機能が同梱されている。

  • Magic Wand:画像の選択した領域だけを修正する部分編集ツール
  • セグメンテーション機能:精密な範囲指定が可能
  • 背景削除ツール:被写体を透過背景付きで書き出す
  • Multi-Ref Editing:最大5枚の入力画像を組み合わせて1枚の画像を生成
  • Smart Resize:既存の画像を任意のアスペクト比に変換し、モデルが空白部分を補完

テンプレートとビデオ制作への布石

xAIはよく使われる画像ワークフローを束ねたプリセットテンプレートも追加している。カテゴリは写真編集、製品写真、マーケティング素材、デザインツール、ゲームアセット、配信用絵文字など多岐にわたる。

さらに、キャラクター・ロケーション・小道具を個別に生成しながら、全体のビジュアルスタイルを統一して保つ機能も公開されている。xAIはこの機能を「フル動画制作ワークフローへの足がかり」と位置づけており、静止画生成からビデオ制作パイプラインへの展開を示唆している。


画像生成AI市場では、OpenAIのGPT-Image-2が高い評価を維持するなか、xAIが短期間でベンチマーク2位に食い込んだ構図は、競争の激しさを改めて示している。API提供が始まった時点で、開発者がどう活用するかが次の焦点になるだろう。

詳細はxAI's Imagine Image 2.0 lands just behind OpenAI's GPT-Image-2 in Arena benchmarksを参照していただきたい。