
Alibaba
Z-Image
〜から $0.004 1枚あたり
Grok Imagine 2.0 は、xAI が 2026 年 8 月 7 日に Grok の新しい Quality Mode として提供を開始した画像生成・編集モデルです。「実務でそのまま使える画像」という一点を目標に設計されており、指示を細部まで守り、デザイナーのようにタイポグラフィとレイアウトを設計し、要素の多い密度の高い画面でも小さな文字が潰れません。通常のテキスト画像生成モデルとの違いは、編集が後付けではなく中核機能である点です。マジックワンドは指定した領域だけを変更し、セグメンテーションは変更範囲を精密に選択し、背景除去は被写体を透過背景で書き出し、マルチ参照編集は 1 回の生成で最大 5 枚の入力画像を受け取ります。xAI の発表が引用する Arena のリーダーボードでは、テキスト画像生成と画像編集の両方で世界 2 位です。モデルは現在 Grok 自社アプリで利用可能で、xAI は API の提供が近いと表明しています。エンドポイントが公開され次第、このページは予告から実際のコンソールに切り替わります。
このモデルで構築して本番に出せる、実際のワークフローとユースケースをご紹介します。

最初の生成が最終素材になることはまずありません。マジックワンドをラベル、空、上着などの領域に向ければ、そこだけが変わり、承認済みの他の部分はそのまま残ります。より正確な範囲が必要なときはセグメンテーションで絞り込めます。
ドキュメントを読む
マルチ参照編集は 1 回の生成で最大 5 枚の入力画像を受け取れるため、キャラクター・ロケーション・小物を手作業のレイヤー合成なしに 1 つの画面へまとめられます。生成器と制作工程の違いはここにあります。

Image 2.0 はデザイナーと同じようにタイポグラフィとレイアウトを設計します。だからポスター、パッケージ、UI モックが「きれい」で終わらず実用に足り、密度の高い構成も崩れず、小さな文字もテクスチャに溶けません。
マジックワンド・セグメンテーション・背景除去は後処理ではなくモデル自体の機能なので、編集しても承認済みの部分は再生成されず保持されます。
マルチ参照編集は最大 5 枚の入力画像を同時に受け取り、生成と実用素材の間にあった手作業の合成工程を置き換えます。
モデルが意図的に組版を設計するため、小さな文字は鮮明に、複数要素の構成は崩れません。AI 画像が差し戻される主因はこの 2 つです。
gpt-image-2 は xAI 自身の発表で 2 つの Arena リーダーボードの 1 位とされ、Image 2.0 は 2 位です。そして gpt-image-2 は今日すでに reAPI で使えます。xAI がこれまでに公表した能力に沿って対照します。
本比較は執筆時点の公開情報(xAI の Imagine Image 2.0 発表、2026 年 8 月 7 日、および OpenAI が公表する gpt-image-2 の機能)に基づきます。Grok Imagine 2.0 は reAPI でまだ呼び出せないため、その列は実測ではなく公表された能力の記述です。順位は xAI が引用する 2026 年 8 月 7 日時点の Arena リーダーボードです。
curl -X POST https://reapi.ai/api/v1/images/generations \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "grok-imagine-image-2",
"prompt": "An editorial product poster with crisp small type",
"aspect_ratio": "3:2"
}'送信時に同期的に拒否され、問題のフィールドが示されます。列挙値・範囲・URL フィールドを確認してください。課金は発生しません。
401 は Bearer キーの欠落または無効、402 は仮押さえ額が残高を超過。キーとクレジットはコンソールで管理できます。
参照素材と生成結果は自動審査を通過します。拒否されたタスクは明確なエラーで失敗し、全額返金されます。
失敗状態に達したタスクは課金されません。仮押さえは自動返金されます。タスク ID を保持して再試行してください。
このモデルに関するよくある質問。