xAI Grok Imagine 2.0 搭載

Grok Imagine 2.0 · xAI のテキスト画像生成

xAI の画像モデルが OVOV に登場。プロンプトを書き、7 種類のアスペクト比から 1 つを選ぶだけで、約 30 秒で 1 枚が仕上がります——画質モードは 1 つ、調整する項目はなし、1 枚 6 クレジットです。

各モデル名およびロゴは、それぞれの所有者の商標です。OVOV は独立した製品であり、いかなるモデル提供元とも提携・推奨・スポンサー関係はありません。

アスペクト比

Grok Imagine 2.0 の実力を見る

すべて OVOV 上の Grok Imagine 2.0 がテキストプロンプトだけで生成した実際の出力です——選り好みも後加工もしていません。

曇天のフラットな光の下で撮影した、もっともらしい不条理な標識で埋め尽くされた道路標識柱

Photorealistic street photograph of an overloaded municipal sign pole on a quiet residential corner,...

2004年の裏庭プールで子ども2人を後ろから写した、日付入りのフラッシュスナップ

A photo taken on a cheap digital camera in the summer of 2004 at a suburban backyard barbecue. Shot ...

液体のような銀の彫刻と OVOV のロゴを配したファッション誌の表紙

High-fashion magazine cover, extreme close-up of an avant-garde metallic sculpture instead of a mode...

波の頂を走る旅客列車をローアングルで捉えたドキュメンタリー写真

Realistic photograph of a full-size passenger train running along the crest of an ocean wave, spray ...

白背景に並ぶ4種の郷土餃子と、それぞれに添えた手書きのレシピカード

A professionally shot photorealistic diagram of four regional dumplings on a white background, each ...

パーティーのステータス、コマンドメニュー、戦闘ログを備えた16ビットRPGの戦闘画面

A screenshot from a fictional 16-bit turn-based RPG battle scene, pixel art, limited palette. The bo...

黄ばんだ紙にオフセット印刷された、1970年代風の災害映画ポスター「THE POUR」

A vintage 1970s disaster-movie poster, offset-printed on slightly yellowed stock. Painted illustrati...

黒い玄武岩の崖に彫り込まれた修道院を、嵐の前のフィヨルド越しに望む風景

A cliffside monastery carved directly into black basalt, seen from across a fjord in the minutes bef...

四面図と構造注記を添えた、ストップモーション用キツネ人形の設定シート

A character reference sheet for a stop-motion film, laid out on grey card. One fox character in felt...

Grok Imagine 2.0 が違う理由

xAI の画像モデルは意図的に用途を絞っています:テキストを入れると、画像が 1 枚出てくるだけ。アップロードもダイヤルも待ち時間もなく、プロンプトと 1 枚のフレームだけの世界です。

xAI ならではの絵づくり

Grok Imagine 2.0 には xAI が学習させたハウススタイルが宿っています——強いコントラスト、迷いのない色、そしてシュールなものへの嗜好。プロンプトを無難なストック画像に平均化せず、態度をもって読み取ります。

テキストから画像へ、それ以外はなし

プロンプトを入れれば画像が出ます。Grok Imagine 2.0 は純粋なテキスト画像生成モデルです——画像のアップロードは受け付けず、すでにある画像を描き直したりレタッチしたりもできません。すべてのフレームがあなたの言葉だけから生成されます。

所要はおよそ 30 秒

1 回の生成は 30 秒ほどで届くので、一文を書き直してもう一度走らせることが、コーヒーブレイクではなく通常の工程になります。

アスペクト比 7 種類

1:1、2:3、3:2、3:4、4:3、9:16、16:9 から選べます——アイコンには正方形、スマホ画面やストーリーズには縦長、バナーやヘッダーには横長を。

画質モードは 1 つだけ

解像度の段階を比べて悩む必要はありません。Grok Imagine 2.0 は固定された 1 つの画質モードで描画し、選んだアスペクト比がフレームの形を決めます。

一律 1 枚 6 クレジット

1 回の生成は 6 クレジットで、画像は 1 枚。どの比率を選んでも料金は同じです。生成に失敗した場合、クレジットはそのまま残高に戻ります。

プロンプトから画像まで 3 ステップ

アップロードするものも設定する項目もありません——書いて、形を選んで、ダウンロードするだけです。

1

プロンプトを書く

被写体、舞台、そして質感を描写します。参照画像のアップロードが使えない以上、欲しいディテールはすべて文章の中に書き込む必要があります。

2

アスペクト比を選ぶ

7 種類の比率——1:1、2:3、3:2、3:4、4:3、9:16、16:9——から 1 つを選び、6 クレジットを使って生成します。

3

保存・共有する

画像は約 30 秒で完成します。作品は OVOV アカウントの「マイ作品」に自動保存されるので、いつでも戻ってダウンロードできます。

作れるもの

プロンプトだけで動く高速なモデルは、手元の画像を直すのではなく、ゼロから新しいビジュアルが欲しい場面でこそ真価を発揮します。

SNS 投稿とバナー

フィード画像、チャンネルアート、キャンペーンバナーを、キャプションからそのまま描き出します——撮影もストック素材のライセンスもアップロードの手間も不要です。

  • ヘッダーやリンクプレビューには 16:9 と 3:2
  • フィード投稿やサムネイルには 1:1
  • アイデア 1 本あたり約 30 秒、5 案は試せます

壁紙とアイコン

画面いっぱいの縦長シーンと、正方形のキャラクターポートレート——スマホとプロフィールが実際に使う 2 つの形です。

  • 9:16 と 3:4 はスマホ画面を端まで埋めます
  • プロフィール写真には 1:1 のポートレート
  • ウォーターマークなしのファイルをそのまま設定できます

コンセプトアートとムードボード

方向性を決める前に探ります。同じアイデアのバリエーションを撃ち込み、生き残ったフレームだけを残しましょう。

  • 一節だけ変えて再生成し、並べて比較
  • 比率を変えて、シーンの切り取られ方を検証
  • 1 案 6 クレジットなので探索コストが低い

ブログとニュースレターの挿絵

記事のヘッダー、セクションの区切り、ニュースレターのイラストを、テンプレートが求める形で必要なときに描画します。

  • よくあるレイアウト枠に合う 16:9 と 2:3
  • スタイルの言い回しを使い回してトーンを統一
  • 書き出した画像はすべて完全な商用利用権付き

Grok Imagine 2.0 プロンプト作成ガイド

このモデルが受け取る入力はプロンプトだけ。被写体もスタイルも光もフレーミングも、すべて一文が背負うことになります。

それ一つで完結する、ディテール豊富なプロンプトが最適

被写体と、その動作から書き始める

Grok Imagine 2.0 は最初に読んだものを軸に構図を組み立てます。被写体を名指しし、動作を与え、それから場所に置きましょう。

  • 形容詞ではなく被写体から始める
  • 被写体に動詞を与える——もたれる、走る、レンズを見据える
  • そのすぐ後に舞台を書けば、モデルはどこに画面を組むか分かります

"A weathered lighthouse keeper hauling rope on a storm-lashed pier, freighters blurred in the distance"

スタイルはほのめかさず、名指しする

真似できる画像がない以上、視覚言語は言葉で明示するしかありません。使ってほしい画材と、フレームが属する時代を言い切りましょう。

  • 画材を名指し:油彩、35mm 写真、セルアニメ、3D レンダー
  • 時代やジャンルを固定:1970 年代の SF ペーパーバック、2000 年代初頭のウェブコラージュ
  • シリーズ全体で同じスタイル表現を使い回して統一感を保つ

"Rendered as a 1970s sci-fi paperback cover, grainy print texture, flat poster colors"

光と配色を描写する

ムードの大半は光が作ります。どこから来る光か、硬いか柔らかいか、どの色が画面を支配すべきかを書きましょう。

  • 光源を名指し:冬の低い日差し、ナトリウム灯、画面の明かり
  • 硬いか柔らかいか、影がどこに落ちるかを指定
  • 配色は 2〜3 色に絞ると全体がまとまります

"Lit by a single sodium streetlamp in fog, hard shadows, amber and deep blue only"

フレーミングをアスペクト比に合わせる

キャンバスは 7 種類の比率から選びます。プロンプトはその形に似合うショットを描写すべきです。広い風景は 16:9 か 3:2、単独の人物は 3:4 か 9:16 に。

  • 風景、群衆、ワイドな状況説明ショットには 16:9 か 3:2
  • 立ち姿、塔、スマホ画面には 9:16 か 3:4
  • ショットの種類を明記——クローズアップ、ウエストショット、ロングショット——すればトリミングが決まります

"Wide 16:9 establishing shot of a canyon town at dawn, figures small in the frame"

書き直して、1 回に 1 か所ずつ反復する

微調整に使える画像入力はないので、改善はテキストの中で起こります。惜しかったプロンプトを残し、一節だけ変えてもう一度走らせましょう。

  • 1 回の生成で変える変数は 1 つ——光、レンズ、配色のどれか
  • うまくいったプロンプトは控えておく。唯一のセーブデータです
  • 形容詞を積み増すのではなく、足りないディテールを足す

"Same canyon town at dawn, but overcast instead of clear, and shot from street level"









今すぐ AI クリエイティブの旅を始めよう

OVOV に参加して、AI で画像・動画・音楽・音声を生成し、無限のクリエイティビティを解き放とう。
新規登録で 10 クレジットを無料プレゼント。待ち時間なし、すぐに創作開始。