Z-Image
阿里巴巴的輕量文字轉圖片模型。以 1 點數即可快速生成單張圖片,支援 5 種長寬比,適合快速概念草稿和社群媒體視覺。
為什麼考慮它
如果下一個任務需要 僅提示詞,可以考慮它。
使用 Grok Imagine Image 2.0 僅以提示詞建立簡潔構圖,或進行參考圖片引導的編輯,讓產品形狀、主體身分、材質、色彩或版面配置引導輸出結果。
範例輸出
Grok Imagine Image 2.0
文字轉圖片 · 圖片轉圖片
範例輸出
Grok Imagine Image 2.0
最適合
支援
線上試用
結果
使用 Grok Imagine Image 2.0 僅以提示詞建立簡潔構圖,或進行參考圖片引導的編輯,讓產品形狀、主體身分、材質、色彩或版面配置引導輸出結果。
目前還沒有結果。提交提示詞即可開始一次任務。
決策適配
決策適配
最適合的任務
任務接近這些情境時使用
安靜事實
提供方
xAI
類別
圖片
能力
文字轉圖片 · 圖片轉圖片
點數模式
per_image · text_to_image=4 · image_edit=4 · ⌈total⌉
輸入路徑
提示詞 + 可選圖片
提示設定
最多 20,000 個字元
Grok Imagine Image 2.0 常見問題
未上傳圖片時,會執行文字生成圖片。使用一至五張已驗證的參考圖片時,會執行標準圖片編輯。Segment Map 與 Segment Edit 目前沒有對應的計價合約,因此無法呼叫。
文字生成圖片接受 1:1、2:3、3:2、16:9 或 9:16。標準圖片編輯除了相同的五種長寬比,也接受自動選項。沒有參考圖片時,系統會拒絕自動選項。
標準圖片編輯需要一至五個不重複的 JPEG、PNG 或 WebP 檔案。每個檔案上限為 10 MB,且必須保留最初透過模型綁定流程上傳時所回傳並簽章的 MIME 類型、尺寸與位元組大小。
Rivya 會在建立工作前預留 4 點數。回報的實際用量若有效且不高於預留額,即可結算工作並退還差額。若未回報實際用量、回報值無效或高於預留額,則維持原預留額並將工作轉入待對帳狀態,不會暗中額外扣除點數。
Rivya 的兩種可用工作流程都接受去除前後空白後為 1 至 20,000 個字元的提示詞。更長的提示詞會遭拒絕,不會在未告知的情況下縮短。
可以。將參考圖片區域留空,輸入提示詞,並從五種固定長寬比中選擇一種,用文字生成圖片。
透過模型綁定的上傳工具上傳一至五張 JPEG、PNG 或 WebP 圖片,說明哪些內容必須保留、哪些內容需要變更,然後選擇固定長寬比或自動選項。
自動選項只適用於圖片編輯工作流程。移除最後一張參考圖片後,Rivya 會將請求切回文字生成圖片,並將長寬比重設為 1:1。
不可以。編輯請求必須使用透過 Rivya 的模型綁定上傳工具所取得的原始簽章中繼資料,讓伺服器能在預留點數前驗證 URL、MIME 類型、尺寸與位元組大小。
此頁面適合針對單一用途進行測試。若要比較提示詞變體、管理多張參考圖片或繼續較長的圖片工作流程,請開啟 Studio。
比較替代模型
阿里巴巴的輕量文字轉圖片模型。以 1 點數即可快速生成單張圖片,支援 5 種長寬比,適合快速概念草稿和社群媒體視覺。
為什麼考慮它
如果下一個任務需要 僅提示詞,可以考慮它。
Nano Banana 2 是 Rivya 較新的 Nano Banana 圖片模型,適合品牌視覺、產品圖片和參考圖主導的創意草稿,尤其是當你想要比基礎級別更當前的 Google 圖片路徑時。
為什麼考慮它
如果點數說明適合下一次執行,可以考慮它:per_image · 1K=5 · 2K=8 · 4K=12 · ⌈total⌉。
Google 的高階圖片模型,支援 4K 輸出、11 種長寬比和最多 8 張參考圖片。針對高保真品牌與行銷活動視覺最佳化,具備更好的細節和色彩準確度。
為什麼考慮它
如果點數說明適合下一次執行,可以考慮它:per_image · 1K=8 · 2K=8 · 4K=14 · ⌈total⌉。
開發者存取
Grok Imagine Image 2.0 已有可呼叫的 Public API 模式,但參考媒體模式仍需要 Files API 上傳支援。提交前請先查看模型參考。