由 xAI Grok Imagine 2.0 驅動

Grok Imagine 2.0 · xAI 文字生圖

xAI 的圖像模型,現已登陸 OVOV。寫下提示詞,從 7 種比例中挑一種,約 30 秒拿到成品——只有一個畫質檔,沒有參數可調,每張 6 點數。

各模型名稱與標識均為其各自所有者的商標。OVOV 為獨立產品,與任何模型提供方均無隸屬、背書或贊助關係。

畫面比例

看 Grok Imagine 2.0 的實際效果

全部都是 OVOV 上 Grok Imagine 2.0 的真實輸出,僅由文字提示詞生成——不挑圖、不後製。

市政路牌桿上掛滿一本正經的荒謬法規牌,陰天平光下拍攝

Photorealistic street photograph of an overloaded municipal sign pole on a quiet residential corner,...

2004 年後院泳池邊兩個孩子的背影閃光快照,帶日期浮水印

A photo taken on a cheap digital camera in the summer of 2004 at a suburban backyard barbecue. Shot ...

時尚雜誌封面,液態銀質雕塑搭配 OVOV 刊頭

High-fashion magazine cover, extreme close-up of an avant-garde metallic sculpture instead of a mode...

一列客運列車行駛在海浪浪尖上的低角度紀實鏡頭

Realistic photograph of a full-size passenger train running along the crest of an ocean wave, spray ...

白底上的四款地方風味餃子,每份配一張手寫食譜卡

A professionally shot photorealistic diagram of four regional dumplings on a white background, each ...

16 位元 RPG 戰鬥畫面,含隊伍狀態、指令選單與戰鬥紀錄

A screenshot from a fictional 16-bit turn-based RPG battle scene, pixel art, limited palette. The bo...

1970 年代復古災難片海報《THE POUR》,泛黃紙張平版印刷質感

A vintage 1970s disaster-movie poster, offset-printed on slightly yellowed stock. Painted illustrati...

鑿刻於黑色玄武岩崖壁的懸崖修道院,暴風雨前隔著峽灣遠眺

A cliffside monastery carved directly into black basalt, seen from across a fjord in the minutes bef...

定格動畫狐狸偶設定表,四視圖並附結構標註

A character reference sheet for a stop-motion film, laid out on grey card. One fox character in felt...

Grok Imagine 2.0 為什麼不一樣

xAI 的圖像模型刻意做得很窄:文字進,一張圖出。不能上傳圖片,沒有參數旋鈕,也不用乾等——一句提示詞,一張成品。

xAI 自己的美學

Grok Imagine 2.0 帶著 xAI 訓練出來的家族風格——高對比、篤定的色彩,以及對超現實的偏好。它讀提示詞是帶著態度的,而不是把它平均成一張安全的圖庫照。

只做文字生圖,別的都不做

提示詞進,圖片出。Grok Imagine 2.0 是純文字生圖模型——它不接受上傳圖片,也無法對既有的圖做重繪或修圖。每一張都只由你的文字生成。

大約 30 秒

一次生成大約半分鐘完成,所以改一句話再跑一次是流程的常態,而不是一次喝咖啡的等待。

7 種比例

可選 1:1、2:3、3:2、3:4、4:3、9:16 或 16:9——方形做頭像,直式適配手機螢幕與限時動態,橫式用於橫幅與頁首。

單一畫質檔

沒有多檔解析度需要權衡。Grok Imagine 2.0 只在一個固定畫質檔下算圖,你選的比例決定畫面的形狀。

每張一律 6 點數

每次生成消耗 6 點數、回傳 1 張圖——不論選哪種比例,價格都一樣。若生成失敗,點數會原路退回你的餘額。

三步驟,從提示詞到成圖

不用上傳,也沒有參數要設定——整個流程就是:寫、選形狀、下載。

1

寫提示詞

描述主體、場景和質感。既然沒有參考圖可用,你想要的每一個細節都必須寫進這句話裡。

2

選一種比例

從 7 種比例中挑一個——1:1、2:3、3:2、3:4、4:3、9:16 或 16:9——然後花 6 點數生成。

3

儲存或分享

約 30 秒後圖片就緒。作品會自動存進你 OVOV 帳號的「我的作品」,隨時都能回來查看與下載。

你可以用它做什麼

一個只吃提示詞的快模型,最適合從零開始要一張新圖的場景,而不是修改一張你手上已經有的圖。

社群貼文與橫幅

動態消息配圖、頻道主視覺、活動橫幅,直接從一句文案生成——不用拍攝,不用買圖庫授權,也沒有上傳這一步。

  • 16:9 與 3:2 適合頁首與連結預覽
  • 1:1 適合動態貼文與縮圖
  • 每個想法約 30 秒,夠你試五版

桌布與頭像

鋪滿螢幕的直式場景與方形角色肖像——手機和個人檔案真正會用到的兩種形狀。

  • 9:16 與 3:4 鋪滿整塊手機螢幕
  • 1:1 肖像用作大頭貼
  • 無浮水印檔案,拿來就能直接用

概念圖與情緒板

在定方向之前先探路。圍繞同一個想法連出幾版,留下活下來的那幾張。

  • 改一個子句再生成,方便對照
  • 混用不同比例,測試場景怎麼裁
  • 每次嘗試 6 點數,探索成本很低

部落格與電子報配圖

文章主圖、段落分隔圖、電子報插圖,按你的版型需要的形狀隨取隨生成。

  • 16:9 與 2:3 契合常見版面位置
  • 沿用同一套風格用語,保持調性一致
  • 每一張匯出都附完整商業使用授權

Grok Imagine 2.0 提示詞寫作指南

提示詞是這個模型唯一的輸入,所以主體、風格、光線和取景都得靠它自己扛。

最適合自成一體、細節充分的提示詞

開頭先寫主體和它在做什麼

Grok Imagine 2.0 會把構圖錨定在它最先讀到的東西上。先點名主體,給它一個動作,再把它放進某個場景。

  • 先寫主體,別先堆形容詞
  • 給主體一個動詞——倚著、奔跑、直視鏡頭
  • 緊接著補上場景,模型才知道要往哪裡搭

範例

"A weathered lighthouse keeper hauling rope on a storm-lashed pier, freighters blurred in the distance"

點名風格,別指望模型猜

沒有圖可以照著抄,視覺語言就必須寫明白。說清楚你要的媒材,以及畫面屬於哪個年代。

  • 點名媒材:油畫、35mm 底片照、賽璐璐動畫、3D 算圖
  • 錨定年代或類型:1970 年代科幻平裝書封、千禧初期網頁拼貼
  • 整組圖沿用同一套風格用語,系列感才立得住

範例

"Rendered as a 1970s sci-fi paperback cover, grainy print texture, flat poster colors"

描述光線與配色

氛圍大半是光決定的。說清楚光從哪裡來、是硬是柔,以及畫面該由哪些顏色主導。

  • 點名光源:冬日低角度陽光、鈉燈路燈、螢幕反光
  • 說明光是硬是柔,陰影落在哪裡
  • 把配色限制在兩三種,整體更統一

範例

"Lit by a single sodium streetlamp in fog, hard shadows, amber and deep blue only"

讓取景配合你選的比例

畫布由你從 7 種比例中挑;提示詞就該描述一個配得上它的鏡頭。開闊場景歸 16:9 或 3:2,單人畫面歸 3:4 或 9:16。

  • 16:9 或 3:2 適合風景、人群與大遠景
  • 9:16 或 3:4 適合站立人物、高塔與手機螢幕
  • 寫清楚景別——特寫、半身、遠景——裁切才會對味

範例

"Wide 16:9 establishing shot of a canyon town at dawn, figures small in the frame"

靠改寫迭代,一次只改一處

沒有圖片輸入可以微調,打磨只能發生在文字裡。留住那條差一點就對的提示詞,改動其中一個子句,再跑一次。

  • 每次只改一個變數——光線、鏡頭或配色
  • 把有效的提示詞存下來;它們是你唯一的存檔
  • 補上缺少的細節,而不是堆更多形容詞

範例

"Same canyon town at dawn, but overcast instead of clear, and shot from street level"









立即開始你的 AI 創作之旅

加入 OVOV,用 AI 生成圖片、影片、音樂與語音,釋放無限創意。
新用戶註冊即送 10 個免費積分,無需等待,即刻開始創作。