Grok Imagine Image 2.0 AI 画像ジェネレーター

Grok Imagine Image 2.0 は1つのモデルで2つの仕事をする。テキストを送れば生成し、参照画像を付ければ編集する。モードの切り替えも X のサブスクリプションも要らない。

0 / 2,000
~40 cr

Grok Imagine Image 2.0 とは?

Grok Imagine Image 2.0 は xAI の画像モデルで、2026年8月7日に Grok Imagine 内の Quality Mode としてリリースされた。独立系のテストは、その強みをフォトリアリズム、同一性の保持、情報の階層 — 絵の上に浮かせた文字ではなく、実際のレイアウトの中に組まれた文字 — に置いている。ここではブラウザ上で1枚ごとに動き、X のサブスクリプションも8時間の割り当て枠も要らない。

欠けている点は具体的だ。4Kティアがないので、印刷スケールの仕事は別のモデルの領分になる。独立系のテストでは、編集の信頼性で GPT Image 2 に劣り — 編集は2回目の実行が必要になりやすい — 非ラテン文字でも劣る。こちらは英語のタイポグラフィから期待するよりずっと当てにならない。写真を別の画材に本当に読み替えるようなスタイル転写も、得意分野ではない。

2026 年 8 月に Grok 内の Quality Mode として公開され、テキストから画像・画像編集の両アリーナで 2 位、上にいるのは GPT Image 2 だけです。ここでは 1 枚ごとの課金でブラウザ上で動き、X のサブスクも、8 時間ごとにリセットされる枠もありません。

Grok Imagine Image 2.0 によるインフォグラフィックのポスター。番号付きの 4 段階、ラベル、本文、脚注のすべてが可読

デザイナーのようにレイアウトを設計します

xAI が 2.0 でいちばんはっきり変えたのはタイポグラフィです。文字を絵の上に散らすのではなく、モデルはまず階層——見出し、サブ見出し、キャプション、ラベル——を組み立て、それから描画します。インフォグラフィックやポスター、パッケージのカンプのような密度の高いものが、小さなサイズで崩れずに保たれるのはそのためです。独立した比較では、表現力のある編集的な佇まいでは GPT Image 2 にわずかに及ばないものの、整理された情報階層では上回るとされています。「読めて整っているものにしてほしい」という依頼なら、こちらのほうが強い選択です。

Grok Imagine Image 2.0 による自然光のポートレート。肌の質感は無修正で、日焼けの跡も自然

先行しているのはフォトリアリズムと顔

独立した比較テストで繰り返し確認されているのは、Grok がフォトリアリズムと、一回の生成を通じて人物の同一性を保つ点で先行しているということです。いずれも AI 画像がふだん最も馬脚を現しやすい領域です。Arena のテキストから画像へのリーダーボードで 2 位(Elo 1320)、編集のリーダーボードでも 2 位(1439)。どちらも GPT Image 2 に次ぐ位置で、これが差の正確な要約です。近いけれども、互角ではありません。

Grok Imagine Image 2.0 による 20:9 のウルトラワイドな海岸のシネマティックカット

ここにある他のモデルが描かない画面の形

たいていの画像モデルは片方向で 21:9、もう片方向で 9:16 が上限だ。これは13種の比率を用意し、その両端よりさらに先へ進む。シネマ的な画面向けに 2:1、19.5:9、20:9、そしてスマホ全面向けにその縦版がある。下の画面は 20:9、このページの下にある松の尾根の壁紙は 9:19.5 だ。どちらもトリミングではない。構図がその形に合わせて組まれている — これが、機能するバナーと空を切り落とした風景写真との差になる。モデルに選ばせたいなら auto もある。

このワークスペースで生成した実際の Grok Imagine Image 2.0 の作例

7 枚すべて 2026 年 8 月 15 日にこの場で生成したもので、いずれも一発出し、プロンプトと設定はそのまま掲載しています。レタッチもしていませんし、大きなバッチから良いものを選んでもいません。所要時間は引用ではなく実測値です。2K medium で 74〜118 秒、1K low で 27 秒。

Grok Imagine Image 2.0 によるインフォグラフィックのポスター。番号付きの 4 段階、ラベル、本文、脚注のすべてが可読
プロンプト2K · 3:4 · 中 · 97秒

A clean modern infographic poster titled 'HOW A HEAT PUMP WORKS' with four numbered stages — ABSORB, COMPRESS, RELEASE, EXPAND — each stage with a simple flat-design icon, a bold stage label and one short caption line of body copy underneath, plus a small footnote line at the bottom, warm neutral palette with terracotta accents, strict grid layout, legible sans-serif typography at every size.

Grok Imagine Image 2.0 による雑誌の表紙。マストヘッド、それぞれリード文を伴う 3 本の表紙見出し、号数情報
プロンプト2K · 2:3 · 中 · 99秒

Magazine cover for a design magazine called 'GRAIN': masthead 'GRAIN' in a heavy serif across the top, a ceramicist's hands shaping clay on a wheel in warm window light, cover lines reading 'The Slow Materials Issue', 'Kilns of Northern Japan' and 'What Hands Know', each with a smaller supporting deck line in light type, issue number and date in the corner, genuinely typeset editorial hierarchy.

Grok Imagine Image 2.0 による自然光のポートレート。肌の質感は無修正で、日焼けの跡も自然
プロンプト2K · 2:3 · 中 · 104秒

Available-light portrait of a man in his fifties in a workshop doorway, weathered skin with visible pores and sun lines, grey stubble, soft overcast key light from the left with a warm bounce from the wood interior, honest unretouched photographic texture, shallow depth of field, 85mm lens.

Grok Imagine Image 2.0 によるパッケージ撮影。ラベルの綴りは正確で、円形スタンプの湾曲した文字も読める
プロンプト2K · 1:1 · 中 · 74秒

Studio packaging photograph of a matte kraft coffee bag standing on pale concrete, front label reading 'NORTHBOUND' in confident sans-serif with a smaller line beneath: 'Ethiopia · Washed · Roasted 04.08', a small circular roaster's stamp in the corner, soft directional light, shallow depth of field, all text crisp and correctly spelled.

Grok Imagine Image 2.0 による 20:9 のウルトラワイドな海岸のシネマティックカット
プロンプト2K · 20:9 · 中 · 118秒

Ultra-wide cinematic frame of a coastal highway at blue hour, a single car's tail lights streaking along the curve, wet asphalt reflecting the last band of orange on the horizon, distant headland silhouettes, anamorphic flare, moody teal-and-amber grade.

Grok Imagine Image 2.0 による 9:19.5 の全画面スマホ壁紙。夜明けの霧に包まれた松の尾根
プロンプト2K · 9:19.5 · 中 · 108秒

Vertical full-screen phone wallpaper: a misty pine ridge at dawn seen from above the cloud layer, layered blue-grey depth planes receding into distance, a thin band of warm sunrise light along the top ridge, minimal and calm, no text.

Grok Imagine Image 2.0 による朝食の俯瞰フラットレイ。最も安い 40 クレジットのティアで生成
プロンプト1K · 3:2 · 低 · 27s — 最も安い 40 クレジットのティア、無加工で掲載

Overhead flat-lay of a weekend breakfast on a linen tablecloth: soft-boiled eggs, sourdough toast, a small bowl of berries and a stovetop espresso pot, warm morning window light, natural food photography.

Grok Imagine Image 2.0 は誰向けか

以下はどれも、このページの上で実証したことに対応している。願望リストではない。

  • インフォグラフィック、スライド、解説図を作る人

    タイトル、番号付きの段階、段階ごとに1行のキャプション、そして脚注が、絵の上に浮くのではなく本物の階層の中に組まれる。2.0 のタイポグラフィ改善が狙っていたのがこの仕事で、このページの最初の画像がまさにその指示だ。

  • パッケージ・ラベルのデザイナー

    表のラベル、補助の1行、焙煎所のスタンプ — 綴りが正しく、指定した位置に収まらなければならない短い文字列だ。コピーは短く保つこと。このモデルが正確でいられるのはそこまでだ。

  • ポートレートとライフスタイルのアートディレクター

    レタッチされたツヤではなく、毛穴、日焼けのシワ、白い無精ひげ、そして現場の光。フォトリアリズムと同一性の保持は、独立系のテストが一貫してこのモデルの側に置く2点だ。

  • 生成と編集を同じモデルでやりたい人

    プロンプトから1枚下描きし、それを参照画像として付け直して変更内容を書く。同じモデル、同じページで、ツールを切り替えたりエディターに上げ直したりする必要がない。

  • 向かない用途:4K印刷、重い編集の反復、非ラテン文字のタイポグラフィ

    ここに4Kティアはなく、編集は GPT Image 2 より2回目の実行が必要になりやすく、非ラテン文字はこのモデルの文字描画でいちばん弱い部分だ。この3つの仕事はモデルを切り替えること — すべて同じ作業環境にあるので、切り替えのコストはクリック1回だ。

Grok Imagine Image 2.0 vs GPT Image 2 vs Seedream 5 Pro

この作業環境で、それぞれがいくらかかり、何を返すか — ベンダーのページではなく、自社レジストリから読み取ったもの。

Grok Imagine Image 2.0GPT Image 2Seedream 5 Pro
出力画像1枚あたりのクレジット1K・低で40 · 1K・中で60 · 2K・低で60 · 2K・中で80解像度×品質に応じて5から5601K で 50 · 2K で 100
解像度ティア1K, 2K1K, 2K, 4K1K, 2K
品質ティア低、中 — 解像度とは別に設定低、中、高 — 解像度とは別に設定なし — 料金は解像度だけで決まる
1リクエストあたりの参照画像最大 3 枚最大 16 枚最大 5 枚
参照画像の課金方法1枚5クレジット、1リクエストにつき1回のみ1枚10クレジット、バッチ枚数で倍になる追加料金なし
1回あたりの生成枚数最大 10最大 101枚 — Pro ティアはバッチ処理をしない
アスペクト比7種のプリセット、1:1 から 16:9 まで15種のプリセット、3:1 と 1:3 まで10種のプリセット+auto、21:9 まで
私たちが計測した生成時間1K・低で27秒 · 2K・中で74〜118秒(7回の実行)2Kで低32秒 · 中68秒 · 高166秒(単発実行)1K で約87秒 · 2K で約107秒(15回の実行)

クレジット、ティア、参照画像の上限、比率の数は、2026年8月20日にこの作業環境自身のモデルレジストリから読み取ったものだ — ベンダーが公表している内容ではなく、ここで得られるものを表している。比率の数からは「auto」を除いてある。auto は比率ではなく設定だからだ。時間は各モデルのページに掲載した実行から取った自前の計測値で、標本数を明記している。3機種を共通のベンチマーク用プロンプトで回してはいないので、直接対決ではなく桁の目安として読んでほしい。

Grok Imagine Image 2.0 に近い画像モデル

Grok Imagine Image 2.0 をほかの画像モデルと比べてみてください。同じワークスペース、切り替えはワンクリックです。

CreateVision AI での Grok Imagine Image 2.0 の仕様

モデルgrok-imagine-image-2.0、xAI 製 — 2026年8月7日に Grok Imagine の Quality Mode としてリリース
モード1つのモデルでテキストから画像と画像から画像 — 参照画像を付けるかどうかで切り替わる
解像度ティア1K と 2K。4Kティアはない。
品質ティア低と中で、解像度とは独立に選ぶ — つまり4通りの組み合わせがすべて使える
アスペクト比7種のプリセット — 1:1、4:3、3:4、16:9、9:16、3:2、2:3 — に auto
1回あたりの生成枚数最大 10
参照画像1リクエストにつき最大3枚
参照画像の課金方法添付画像1枚につき5クレジット。出力画像ごとではなくリクエスト全体につき1回だけ課金されるので、バッチにすればその費用は分散する
出力画像1枚あたりのクレジット1K・低で40 · 1K・中で60 · 2K・低で60 · 2K・中で80
アプリ内の編集ツール利用不可 — マジックワンド、セグメンテーション、背景除去は xAI 自身のアプリの機能であって、モデルの機能ではない。ここでの編集はプロンプトで行う。
実測スピード1K・低で27秒、2K・中で74〜118秒 — 2026年8月15日に行った7回の生成

Grok Imagine Image 2.0 の使い方

空のプロンプト欄から、完成した画像まで3ステップ。

  1. 1

    Grok Imagine Image 2.0 を選択

    モデルピッカーを開いて Grok Imagine Image 2.0 を選びます。クレジット消費、解像度の選択肢、アスペクト比は、何かを消費する前にパネルに表示されます。

  2. 2

    欲しい画を説明する

    被写体、シーン、光、仕上がりを書きます。モデルが対応していれば参照画像も添付できます。

  3. 3

    生成して、その先へ

    結果をダウンロード、あるいはそのまま続けて編集・スタイル変更・アップスケール・動画化も。生成ごとにプロンプトとパラメータが保存されます。

Grok Imagine Image 2.0 のその先へ

一つのアカウントで、画像・動画生成ワークフローのすべてを。

Grok Imagine Image 2.0 の料金と毎日の無料クレジット

無料プランの毎日のクレジットで Grok Imagine Image 2.0 を使うか、アップグレードしてプレミアムモデル、より速い生成、4K 出力を利用してください。

無料

$0

始めるのに最適

  • 200 ウェルカムクレジット、1日最大 80 まで
  • Z Image Turboは0クレジットで下書き
  • 標準の生成速度
  • 生成履歴を含む
始める

プレミアム

一番人気
$29/month

年額請求 · $240/年

  • 月間 8,000 クレジット、1日の上限なし
  • すべてのプレミアムモデル――GPT Image 2、Nano Banana、Seedream、Seedance、Veo、Kling
  • 5倍の生成速度、優先キュー
  • AIプロンプト強化
プレミアム にアップグレード

Ultimate

$49/month

年額請求 · $380/年

  • 月間 18,000 クレジット、1日の上限なし
  • 最大4K解像度のHD生成
  • 優先サポート
  • 最速のキューと新モデルへの早期アクセス
Ultimate にアップグレード

Grok Imagine Image 2.0 — よくある質問

1

Grok Imagine Image 2.0 とは?

xAI の画像モデル。2026 年 8 月 7 日に Grok Imagine 内の Quality Mode として公開されました。一つのモデルがテキストから画像への生成と画像編集の両方をカバーし、どちらになるかは参照画像を添付するかどうかだけで決まります。

2

実際のところ、どれくらい良いのか

テキストから画像・画像編集の両アリーナで 2 位、いずれも GPT Image 2 に次ぐ位置です(生成は Elo 1320 対 1380、編集は 1439 対 1463)。独立した比較テストは、強みをフォトリアリズム、同一性の保持、情報階層の整理に、弱みを編集の安定性、多言語テキスト、スタイル変換に見ています。

3

利用に X のサブスクリプションや SuperGrok は必要ですか?

ここでは不要です。xAI 自身のプラットフォームでは画像の生成と編集は有料サブスクリプションの内側にあり、割り当てが大幅に削られたという報告もあります。CreateVision AI では 1 枚 40 クレジットからの従量制で、サブスクの加入義務も API キーも、8 時間ごとにリセットされる枠もありません。

4

コストはいくらですか?

1 枚 40 クレジットから。1K は low で 40 クレジット、medium で 60。2K はそれぞれ 60 と 80 です。参照画像は 1 枚につき 5 クレジット追加で、出力画像ごとではなくリクエストごとに一度だけ課金されます。そのため参照付きの編集はまとめて実行したほうが 1 枚あたり安くなります。設定に応じた合計は、生成する前にボタン上に表示されます。

5

Grok アプリのマジックワンドや背景除去は含まれますか?

含まれません。あれらは xAI 自身のアプリ内のインタラクティブなツールで、モデル API の一部ではありません。ここでの編集はプロンプト駆動です。参照画像を最大 3 枚添付し、変更内容を言葉で説明してください。クリックで選択する背景除去には、専用の AI 背景除去ツールをお使いください。

6

参照画像は何枚まで添付できますか?

このワークスペースでは最大 3 枚です。xAI のファーストパーティ・アプリはそれ以上を受け付けますが、このモデルが動いている API の上限は 3 枚です。マーケティング上の数字ではなく、実際の数字を書いておきます。

7

対応している解像度とアスペクト比は?

解像度は 1K と 2K の2ティアで、4K はない。アスペクト比は7種:1:1、4:3、3:4、3:2、2:3、16:9、9:16。このモデルに auto モードはないので、実行前に画面の形を選ぶこと。

8

low と medium の品質ティアは何が違いますか?

low は約 10 秒の高速ティアで、下書きやプロンプトの言い回しを試すのに向いています。medium はもっと時間がかかり——xAI は 10〜75 秒としています——そのぶん細部まで描き込みます。ティアは解像度とは独立しているので、どちらも 1K とも 2K とも組み合わせられます。

サブスクなしで Grok Imagine Image 2.0 を使う

画像の生成を始める

ワンクリック AI 画像ツールを見る

生成の前後の作業はワンクリックで——仕上げ、スタイル変更、共有まで。

料金とアクセス — 基本情報Grok Imagine Image 2.0

モデル
Grok Imagine Image 2.0
開発元
xAI
アクセス方法
CreateVision AI のワークスペース内で API 経由で動作します。ログインするだけで生成でき、API キーもクラウド設定もインストールも不要です。
1 回あたりの料金
1 枚あたり 60 クレジット〜 ≈ $0.22(Premium プラン換算:月額 $29 で 8,000 クレジット)。 無料プランには毎日 80 クレジットが含まれます。
プライバシー
デフォルトで非公開 — どのプランでも、他のユーザーがあなたの生成物を見ることはありません。会員データを販売・悪用することはありません。 プライバシーポリシー

最新アップデートGrok Imagine Image 2.0

  1. New

    Grok Imagine Image 2.0 (xAI) integrated — text-to-image and image editing share one model, 1K/2K at two speed tiers, up to 3 reference images and batch up to 10. No API key or X Premium subscription needed.