AIToday
画像生成AIビジネス・産業THE DECODER掲載日時: 2026年8月8日 19:006分で読める

xAI「Imagine Image 2.0」がArenaベンチマークで2位に

LINEで送る
xAI「Imagine Image 2.0」がArenaベンチマークで2位に

要点

  • xAIはImagine Image 2.0をリリースした。同モデルは2026年8月7日時点のArenaベンチマークで第2位にランクされ、OpenAIのGPT-Image-2にのみ次ぐ。

  • grok.com/imagineおよびGrokのモバイルアプリ上でQuality Modeとして利用可能であり、APIアクセスは近日提供予定。

  • Magic WandやMulti-Ref Editingなどの編集ツール、一般的なワークフロー向けの事前設定テンプレート、将来のビデオ制作に対応するキャラクター生成機能を備えている。

3つのポイント

  1. 何が起きたか

    xAIが新しいQuality ModeとしてImagine Image 2.0をgrok.com/imagineおよびGrokのiOSアプリとAndroidアプリでローンチした。API アクセスは近日提供予定。2026年8月7日時点のArenaリーダーボードでは、より高速な「low」バリアントが、Image Edit Arenaで1,439のEloレーティング(OpenAIのGPT-Image-2の1,463に次ぐ)、Text-to-Image Arenaで1,320(GPT-Image-2の1,380に次ぐ)を記録している。

  2. なぜ重要か

    本モデルは細粒度の指示に従うこと、複雑な画像における文字体裁とレイアウトの一貫性を維持すること、複数世代にわたる一貫性を保つことを目的に設計されており、商用画像生成における強力な競争相手として位置付けられている。新リリースは同じベンチマークにおいて先代の「Quality」バリアントを大幅に上回る性能を示している。

  3. 注目点

    Imagine Image 2.0は、Magic Wand(選択領域を修正)、セグメンテーション、背景除去、Multi-Ref Editing(最大5つの入力画像を結合)、Smart Resize(画像を任意のアスペクト比に変換)などの編集ツールを備えている。xAIは写真編集、商品写真撮影、マーケティング資料、デザインツール、ゲームアセット、ストリーミング絵文字向けのテンプレートも提供しており、完全なビデオ制作ワークフローへの足がかりとして、一貫性のあるキャラクター、ロケーション、小道具を生成する機能を公開している。

詳細

全文を読む

xAIはImagine Image 2.0をリリースした。同モデルはgrok.com/imagineのQuality Modeおよび、GrokのiOSアプリケーションとAndroidアプリケーション内で即座に利用可能である。APIアクセスは後日提供される予定である。同社は本モデルが細粒度の精度で指示に従うこと、複雑な画像における清潔な文字体裁とレイアウトを維持すること、複数の生成にわたって視覚的一貫性を保つことが可能であると説明している。

2026年8月7日付のArenaリーダーボードによれば、Imagine Image 2.0のより高速な「low」バリアントは両主要評価カテゴリ全体で世界第2位にランクされている。Image Edit Arenaではエロレーティングが1,439を達成し、OpenAIのGPT-Image-2の1,463に次ぐ。Text-to-Image Arenaでは1,320を獲得し、再びGPT-Image-2の1,380を下回る。Reve 2.1、MetaのMuse-Image、AlibabaのQwen-Image-3.0-Pro、GoogleのGemini、ByteDanceのSeedDreamを含む競争相手はリーダーボードではさらに下位にランクされている。新モデルはベンチマークにおいて先代の「Quality」バリアントを大幅に上回る性能を発揮している。

Imagine Image 2.0は反復的なクリエイティブ作業向けに設計された複数の編集ツールを備えている。Magic Wandと呼ばれる機能は画像の選択領域のみを修正し、セグメンテーションツールにより利用者は正確な領域を選択できる。背景除去ツールは透明背景で被写体をエクスポートする。Multi-Ref Editingにより最大5つの入力画像を単一の生成に結合することが可能である。Smart Resizeは既存画像を任意のアスペクト比に変換し、モデルが自動的に追加スペースを埋める。

xAIはまた、写真編集、商品写真撮影、マーケティング資料、デザインツール、ゲームアセット、ストリーミング絵文字を含むカテゴリにおいて、一般的なワークフローを事前設定された開始点にバンドルするテンプレートを導入している。同社は、キャラクター、ロケーション、小道具を個別に生成しながら、すべての画像全体で一貫した視覚スタイルを維持する機能を展示している。xAIはこの機能をビデオ制作ワークフロー全体の基盤として説明している。xAIによれば、Imagine 2.0はビデオ制作の出発点として機能するキャラクター、小道具、ロケーションを備えた一貫性のある視覚世界を生成できる。

背景と解説

xAIのImagine Image 2.0は、現在ArenaベンチマークでOpenAIのGPT-Image-2がリードしている競争激しい市場に参入した。本モデルがOpenAIの製品のすぐ後ろに位置することは、最も一般的な2つのユースケース、すなわち画像編集とテキスト・ツゥ・イメージ生成において、xAIがほぼ同等の性能を実現したことを示している。同社が細粒度の指示追従性と世代を超えた一貫性に重点を置いていることは、プロフェッショナルワークフローにおける実務的なニーズに対応するもので、レイアウト保持とスタイル統一は出力品質に直結する。

バンドルされた機能セット(特に編集ツールとテンプレート)から、xAIは個別クリエイターだけでなく、商品写真、マーケティング、デザインアセットに取り組むチームをターゲットとしていることが伺える。Multi-Ref EditingとConsistentキャラクター生成システムは、xAIのビデオ制作への戦略的指向を示唆しており、Imagine 2.0は単なるイメージツールではなく、将来のマルチメディアワークフロー向けの基盤として位置付けられている。

よくある質問

Imagine Image 2.0にアクセスするにはどうすればよいですか?
Imagine Image 2.0はgrok.com/imagineのQuality ModeおよびGrokのiOSアプリとAndroidアプリで利用可能です。APIアクセスは近日提供予定です。
Imagine Image 2.0は他の画像モデルとどう比較されますか?
2026年8月7日時点のArenaリーダーボードでは、Imagine Image 2.0のより高速な「low」バリアントが世界的に第2位にランクされており、Image Edit Arenaで1,439(OpenAIのGPT-Image-2の1,463に次ぐ)、Text-to-Image Arenaで1,320(GPT-Image-2の1,380に次ぐ)のスコアを記録しています。
Imagine Image 2.0にはどのような編集機能がありますか?
本モデルはMagic Wand(選択領域を修正)、セグメンテーション(正確な領域指定)、背景除去、Multi-Ref Editing(最大5つの入力画像を単一の生成に結合)、Smart Resize(画像を任意のアスペクト比に変換し、モデルが追加スペースを自動補完)を備えています。

「画像生成」の最新ニュースを、毎朝7時にお届けします

AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。

登録無料・30秒で完了・いつでも解除できます

AIに質問

この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。

関連記事

次の記事へJEDEC、AI向けメモリ規格SPHBM4を発表 512ビット化で低価格化へ

AIニュースの要点を毎朝1分で。

無料で登録