Alibaba
Z-Image
阿里巴巴的輕量文字轉圖片模型。以 1 點數即可快速生成單張圖片,支援 5 種長寬比,適合快速概念草稿和社群媒體視覺。
為什麼選它
每次生成 1 點數,是目前最低的圖片入門級別
- 最適合
- 便宜的第一版視覺概念
- 輸入
- 文字
- 輸出
- 圖片
- 點數
- per_image · default=0.8 · ⌈total⌉
依任務、輸入、輸出、提供方和點數說明瀏覽 131+ 個 AI 模型。了解每個模型擅長什麼、查看真實範例,再把候選清單帶進 Rivya 實測。
依模態、輸入類型、提供方、優勢和點數說明縮小範圍。開啟模型頁即可查看真實輸出、任務適配度和快速線上試用。
Alibaba
阿里巴巴的輕量文字轉圖片模型。以 1 點數即可快速生成單張圖片,支援 5 種長寬比,適合快速概念草稿和社群媒體視覺。
為什麼選它
每次生成 1 點數,是目前最低的圖片入門級別
Google 的靈活圖片模型,支援文字轉圖片和圖片轉圖片,包含 11 種長寬比、最多 10 張參考圖片,以及 PNG/JPEG 輸出。很適合人像、產品構圖和更寬的登陸頁視覺。
為什麼選它
11 種長寬比,包含超寬 21:9 和自動模式
Black Forest Labs
Black Forest Labs 的 320 億參數旗艦模型。支援文生圖和圖生圖,最多 8 張參考圖、2K 解析度,以及精準的圖片內文字渲染,專為產品攝影和品牌視覺打造。
為什麼選它
最高 2K 解析度,呈現寫實材質
OpenAI
GPT-5.5 已收錄在 Rivya,但目前處於接入安全暫停狀態;可索引的狀態頁會繼續保留,對話呼叫仍維持關閉。
為什麼選它
在 Rivya 追蹤 GPT-5.5 的狀態,並在安全預授權尚待核驗期間比較目前可呼叫的 Claude 替代模型。
OpenAI
GPT-5.4 已收錄在 Rivya,但目前處於接入安全暫停狀態;可索引的狀態頁會繼續保留,對話呼叫仍維持關閉。
為什麼選它
在 Rivya 追蹤 GPT-5.4 的狀態,並在安全預授權尚待核驗期間比較目前可呼叫的 Claude 替代模型。
OpenAI
GPT-5.4 Codex 已收錄在 Rivya,但目前處於接入安全暫停狀態;可索引的狀態頁會繼續保留,對話呼叫仍維持關閉。
為什麼選它
在 Rivya 追蹤 GPT-5.4 Codex 的狀態,並在安全預授權尚待核驗期間比較目前可呼叫的 Claude 替代模型。
OpenAI
GPT-5.3 Codex 已收錄在 Rivya,但目前處於接入安全暫停狀態;可索引的狀態頁會繼續保留,對話呼叫仍維持關閉。
為什麼選它
在 Rivya 追蹤 GPT-5.3 Codex 的狀態,並在安全預授權尚待核驗期間比較目前可呼叫的 Claude 替代模型。
OpenAI
GPT-5.2 已收錄在 Rivya,但目前處於接入安全暫停狀態;可索引的狀態頁會繼續保留,對話呼叫仍維持關閉。
為什麼選它
在 Rivya 追蹤 GPT-5.2 的狀態,並在安全預授權尚待核驗期間比較目前可呼叫的 Claude 替代模型。
OpenAI
GPT-5.2 Codex 已收錄在 Rivya,但目前處於接入安全暫停狀態;可索引的狀態頁會繼續保留,對話呼叫仍維持關閉。
為什麼選它
在 Rivya 追蹤 GPT-5.2 Codex 的狀態,並在安全預授權尚待核驗期間比較目前可呼叫的 Claude 替代模型。
OpenAI
GPT-5.1 Codex 已收錄在 Rivya,但目前處於接入安全暫停狀態;可索引的狀態頁會繼續保留,對話呼叫仍維持關閉。
為什麼選它
在 Rivya 追蹤 GPT-5.1 Codex 的狀態,並在安全預授權尚待核驗期間比較目前可呼叫的 Claude 替代模型。
OpenAI
GPT-5 Codex 已收錄在 Rivya,但目前處於接入安全暫停狀態;可索引的狀態頁會繼續保留,對話呼叫仍維持關閉。
為什麼選它
在 Rivya 追蹤 GPT-5 Codex 的狀態,並在安全預授權尚待核驗期間比較目前可呼叫的 Claude 替代模型。
Gemini 3.1 Pro 已收錄在 Rivya,但目前處於接入安全暫停狀態;可索引的狀態頁會繼續保留,對話呼叫仍維持關閉。
為什麼選它
在 Rivya 追蹤 Gemini 3.1 Pro 的狀態,並在安全預授權尚待核驗期間比較目前可呼叫的 Claude 替代模型。
Gemini 3 Pro 已收錄在 Rivya,但目前處於接入安全暫停狀態;可索引的狀態頁會繼續保留,對話呼叫仍維持關閉。
為什麼選它
在 Rivya 追蹤 Gemini 3 Pro 的狀態,並在安全預授權尚待核驗期間比較目前可呼叫的 Claude 替代模型。
Gemini 3 Flash 已收錄在 Rivya,但目前處於接入安全暫停狀態;可索引的狀態頁會繼續保留,對話呼叫仍維持關閉。
為什麼選它
在 Rivya 追蹤 Gemini 3 Flash 的狀態,並在安全預授權尚待核驗期間比較目前可呼叫的 Claude 替代模型。
Gemini 2.5 Pro 已收錄在 Rivya,但目前處於接入安全暫停狀態;可索引的狀態頁會繼續保留,對話呼叫仍維持關閉。
為什麼選它
在 Rivya 追蹤 Gemini 2.5 Pro 的狀態,並在安全預授權尚待核驗期間比較目前可呼叫的 Claude 替代模型。
Gemini 2.5 Flash 已收錄在 Rivya,但目前處於接入安全暫停狀態;可索引的狀態頁會繼續保留,對話呼叫仍維持關閉。
為什麼選它
在 Rivya 追蹤 Gemini 2.5 Flash 的狀態,並在安全預授權尚待核驗期間比較目前可呼叫的 Claude 替代模型。
Anthropic
Anthropic 在 Rivya 上的旗艦 Claude 聊天模型,適合深度推理、謹慎整合、主管寫作和高影響力文字工作。
為什麼選它
旗艦級文字推理和整合能力
Anthropic
Claude Opus 4.6 已收錄在 Rivya,但目前處於接入安全暫停狀態;可索引的狀態頁會繼續保留,對話呼叫仍維持關閉。
為什麼選它
在 Rivya 追蹤 Claude Opus 4.6 的狀態,並在安全預授權尚待核驗期間比較目前可呼叫的 Claude 替代模型。
Anthropic
Anthropic 在 Rivya 上的均衡型 Claude AI 聊天模型。它保留強大的長文推理和謹慎分析,適合內容、研究和程式設計專案,同時不必直接跳到 Opus 層級的花費。
為什麼選它
可靠推理和均衡品質
Anthropic
Claude Opus 4.5 已收錄在 Rivya,但目前處於接入安全暫停狀態;可索引的狀態頁會繼續保留,對話呼叫仍維持關閉。
為什麼選它
在 Rivya 追蹤 Claude Opus 4.5 的狀態,並在安全預授權尚待核驗期間比較目前可呼叫的 Claude 替代模型。
Anthropic
Anthropic 在 Rivya 上的均衡型 Claude AI 聊天模型。它擅長細膩寫作、謹慎分析和注重安全的回應,是內容創作和研究中很穩的 Claude 選項。
為什麼選它
細膩寫作和謹慎分析
Anthropic
Anthropic 在 Rivya 上的輕量 Claude AI 聊天模型。它針對速度、成本效率和穩定的日常聊天表現調整,適合想要 Claude 語氣但不想使用高階方案成本的高頻專案。
為什麼選它
更適合低延遲、高頻使用
Anthropic
Rivya 上以文字為主的 Claude 對話模型,適合審閱高密度資料包並形成審慎、結構化的決策結論。
為什麼選它
以文字為主的資料整合
Anthropic
Rivya 上以文字為主的 Claude 對話模型,適合敘事重構、面向特定讀者的草稿和結構化編輯工作。
為什麼選它
面向目標讀者的敘事重構
Anthropic
Rivya 上以文字為主的 Claude 對話模型,適合實作簡報、需求審閱和精煉的技術規劃。
為什麼選它
面向實作的結構
Anthropic
Rivya 上以文字為主的 Claude 對話模型,適合董事會層級的風險梳理、情境比較和決策記錄。
為什麼選它
風險與情境框架
OpenAI
GPT-5.6 Luna 已收錄在 Rivya,但目前處於接入安全暫停狀態;可索引的狀態頁會繼續保留,對話呼叫仍維持關閉。
為什麼選它
在 Rivya 追蹤 GPT-5.6 Luna 的狀態,並在安全預授權尚待核驗期間比較目前可呼叫的 Claude 替代模型。
OpenAI
GPT-5.6 Terra 已收錄在 Rivya,但目前處於接入安全暫停狀態;可索引的狀態頁會繼續保留,對話呼叫仍維持關閉。
為什麼選它
在 Rivya 追蹤 GPT-5.6 Terra 的狀態,並在安全預授權尚待核驗期間比較目前可呼叫的 Claude 替代模型。
OpenAI
GPT-5.6 Sol 已收錄在 Rivya,但目前處於接入安全暫停狀態;可索引的狀態頁會繼續保留,對話呼叫仍維持關閉。
為什麼選它
在 Rivya 追蹤 GPT-5.6 Sol 的狀態,並在安全預授權尚待核驗期間比較目前可呼叫的 Claude 替代模型。
Gemini 3.5 Flash 已收錄在 Rivya,但目前處於接入安全暫停狀態;可索引的狀態頁會繼續保留,對話呼叫仍維持關閉。
為什麼選它
在 Rivya 追蹤 Gemini 3.5 Flash 的狀態,並在安全預授權尚待核驗期間比較目前可呼叫的 Gemini 替代模型。
Gemini 3.6 Flash 已收錄在 Rivya,但目前處於接入安全暫停狀態;可索引的狀態頁會繼續保留,對話呼叫仍維持關閉。
為什麼選它
在 Rivya 追蹤 Gemini 3.6 Flash 的狀態,並在安全預授權尚待核驗期間比較目前可呼叫的 Gemini 替代模型。
Gemini 3.7 Flash 已收錄在 Rivya,但目前處於整合安全暫停狀態;可索引的狀態頁會追蹤已確認的對話規格,執行功能則維持關閉。
為什麼選它
研究 Gemini 3.7 Flash 在編碼、代理與複雜工作流程的用途,並在安全點數預授權問題尚未解決期間,比較目前可呼叫的 Gemini 替代模型。
xAI
Grok 4.3 — 暫時無法使用. Grok 4.3 仍在整合安全暫停時,先使用可呼叫的替代模型繼續工作。
為什麼選它
Grok 4.3 — Grok 4.3 執行處於安全暫停. Grok 4.3 仍在整合安全暫停時,先使用可呼叫的替代模型繼續工作。
xAI
Grok 4.5 — 暫時無法使用. Grok 4.5 仍在整合安全暫停時,先使用可呼叫的替代模型繼續工作。
為什麼選它
Grok 4.5 — Grok 4.5 執行處於安全暫停. Grok 4.5 仍在整合安全暫停時,先使用可呼叫的替代模型繼續工作。
xAI
Grok 4.6 — 暫時無法使用. Grok 4.6 仍在整合安全暫停時,先使用可呼叫的替代模型繼續工作。
為什麼選它
Grok 4.6 — Grok 4.6 執行處於安全暫停. Grok 4.6 仍在整合安全暫停時,先使用可呼叫的替代模型繼續工作。
Kimi
Kimi K3 是即將推出的 Chat 模型。本頁追蹤可用狀態並提供現有對話模型,不聲稱未發布的上下文、工具或回應行為。
為什麼選它
追蹤 Kimi K3 Chat 的接入狀態,並比較目前可在 Rivya 使用的對話模型。
Alibaba
阿里巴巴的輕量文字轉圖片模型。以 1 點數即可快速生成單張圖片,支援 5 種長寬比,適合快速概念草稿和社群媒體視覺。
為什麼選它
每次生成 1 點數,是目前最低的圖片入門級別
Nano Banana 2 是 Rivya 較新的 Nano Banana 圖片模型,適合品牌視覺、產品圖片和參考圖主導的創意草稿,尤其是當你想要比基礎級別更當前的 Google 圖片路徑時。
為什麼選它
最高 4K 解析度(可選 1K / 2K / 4K)
Google 的高階圖片模型,支援 4K 輸出、11 種長寬比和最多 8 張參考圖片。針對高保真品牌與行銷活動視覺最佳化,具備更好的細節和色彩準確度。
為什麼選它
最高 4K 解析度,保真度更高
Google 的靈活圖片模型,支援文字轉圖片和圖片轉圖片,包含 11 種長寬比、最多 10 張參考圖片,以及 PNG/JPEG 輸出。很適合人像、產品構圖和更寬的登陸頁視覺。
為什麼選它
11 種長寬比,包含超寬 21:9 和自動模式
OpenAI
OpenAI 在 Rivya 上較新的 GPT Image 模型,支援 text-to-image、image-to-image、最多 16 張參考圖片,以及清楚的 1K / 2K / 4K 點數層級。
為什麼選它
在同一個 Rivya 模型頁支援 text-to-image 和 image-to-image
OpenAI
OpenAI 的圖片模型,具備中等/高品質兩個品質層級,並支援最多 16 張參考圖片。擅長遵循複雜指令,並渲染空間關係準確的連貫場景。
為什麼選它
最多 16 張參考圖片,是 Rivya 上最高的參考上限
OpenAI
OpenAI 的 4o Image 模型現在已在 Rivya 作為專用文生圖路徑提供。目前頁面設定刻意保持精簡:提示詞加上 3 種支援比例,並以固定每張圖片 3 點數計價。
為什麼選它
保留專用 OpenAI 4o Image 入口,而不是併入其他模型
ByteDance
字節跳動較輕量的 Seedream 圖片模型,文字轉圖片和圖片編輯共用同一套價格。它支援 8 種長寬比、最多 14 張參考圖片,目前每次執行花費 6 點數。
為什麼選它
文字轉圖片和圖片轉圖片都採固定 6 點數價格
ByteDance
字節跳動的高階圖片模型,具備 2K/4K 品質級別、8 種長寬比,以及最多 14 張參考圖片。以電影感調色和豐富紋理細節見長,適合時尚和生活風格視覺。
為什麼選它
可選 2K(基本)和 4K(高品質)品質級別
ByteDance
此請求暫時無法使用,請稍後重試。
ByteDance
此請求暫時無法使用,請稍後重試。
xAI
xAI 的圖片模型,具備強烈創意詮釋能力和 5 種長寬比。標準文字請求會傳回 2 張圖,品質請求則傳回 4 張。
為什麼選它
強烈的創意和藝術詮釋能力
Black Forest Labs
Black Forest Labs 的 320 億參數旗艦模型。支援文生圖和圖生圖,最多 8 張參考圖、2K 解析度,以及精準的圖片內文字渲染,專為產品攝影和品牌視覺打造。
為什麼選它
最高 2K 解析度,呈現寫實材質
Black Forest Labs
Flux 2 系列中偏向編輯的變體。它擅長結構調整和風格轉換,最多支援 8 張參考圖與 2K 解析度,適合在既有視覺上反覆迭代。
為什麼選它
針對圖片編輯和風格轉換最佳化
Black Forest Labs
BFL 目前將 FLUX.1 Kontext [max] 標為上一代,並建議新專案使用 FLUX.2。 Black Forest Labs 強化版 Flux Kontext 模型,適合要求較高、由提示詞引導的生成與圖片編輯。Rivya 在同一個模型頁面提供文生圖和圖生圖,固定每次執行 8 點數。
為什麼選它
Rivya 上生成與編輯皆採固定 8 點數定價
Black Forest Labs
BFL 目前將 FLUX.1 Kontext [pro] 標示為上一代,並建議新專案使用 FLUX.2。 Black Forest Labs 較低成本的 Flux Kontext 模型,適合文生圖和單圖編輯。Rivya 在同一個模型頁面提供兩種模式,固定每次執行 4 點數。
為什麼選它
Rivya 上生成與編輯皆採固定 4 點數定價
Alibaba
阿里巴巴的 Qwen2 圖片模型目前在 Rivya 上整合為固定價格的圖片選項。它安全涵蓋文字轉圖片和圖片轉圖片,採用兩份公開文件都列出的共同長寬比子集,並提供 PNG/JPEG 輸出、隨機種子重用和簡單 NSFW 開關。
為什麼選它
文字轉圖片和圖片轉圖片都採固定 6 點數價格
Alibaba
阿里巴巴 Qwen 系列的圖片模型,具備 HD 預設(方形、直向、橫向)和 PNG/JPEG 輸出。擅長中文提示詞和具文化細節的視覺生成。
為什麼選它
HD 預設尺寸:方形、直向 4:3/16:9、橫向 4:3/16:9
Midjourney
此請求暫時無法使用,請稍後重試。
Recraft
Recraft 在 Rivya 上的去背景模型,適合從一張既有圖片中分離主體。當下一步需要透明素材、乾淨去背圖,或沒有原始背景的來源圖片時,可以使用它。
為什麼選它
單用途去背工具,固定 1 點數價格
Recraft
Recraft 在 Rivya 上的輕量圖片放大模型,適合對一張已確認的靜態圖片做低成本銳化和清晰度補強。當選定圖片只需要匯出前的便宜修飾,而不是更重的交付級放大時,可以使用它。
為什麼選它
針對單張上傳圖片的固定 1 點數清理步驟
Alibaba
在 Rivya 上,Wan 2.7 Image Pro 目前支援文字轉圖片和圖片轉圖片。它也可以使用最多 9 張參考圖片。 每張圖片固定 12 點數; 每次請求回傳一張圖片.
為什麼選它
每張圖片固定 12 點數; 每次請求回傳一張圖片.
Alibaba
在 Rivya 上,Wan 2.7 Image 目前支援文字轉圖片和圖片轉圖片。它也可以使用最多 9 張參考圖片。 每張圖片固定 5 點數; 每次請求回傳一張圖片.
為什麼選它
每張圖片固定 5 點數; 每次請求回傳一張圖片.
Google Imagen4 Ultra 是 Rivya 高階的 Imagen 文生圖檔位。它目前以固定 12 點數的單張圖片專案整合,提供公開的提示詞、反向提示詞、長寬比和種子值控制。
為什麼選它
Rivya 上固定 12 點數定價
Google Imagen4 是 Rivya 標準的 Imagen 文生圖檔位。它目前以固定 8 點數的單張圖片專案整合,提供公開的提示詞、反向提示詞、長寬比和種子值控制。
為什麼選它
Rivya 上固定 8 點數定價
Google Imagen4 Fast 是 Rivya 輕量級的 Imagen 文生圖檔位。它目前保留單張圖片專案,採固定 4 點數定價,並公開提示詞、反向提示詞、長寬比和種子值控制,不開放多圖輸出。
為什麼選它
Rivya 上固定 4 點數定價
Topaz
Topaz 在 Rivya 上的交付級圖片放大工具,適合已核准靜態圖需要真正提升尺寸時使用。當構圖已經定稿,剩下的問題是匯出解析度、審稿尺寸或印刷準備度時使用它。
為什麼選它
專為需要真正交付尺寸提升的已核准靜態圖而設,不是重新生成構圖
Ideogram
Ideogram V3 是 Rivya 的 text-to-image 模型,適合文字渲染、海報版式和設計優先的圖片提示詞。目前價格為 TURBO 4 點數、BALANCED 7 點數、QUALITY 10 點數。
為什麼選它
渲染速度層級:TURBO、BALANCED、QUALITY
Ideogram
此請求暫時無法使用,請稍後重試。
Ideogram
Ideogram V3 Remix: 每張圖 TURBO 4 / BALANCED 7 / QUALITY 10 點數. 可選 1–4 張輸出。總價按單張價格乘以所選張數計算,並向上取整為整數點數。
為什麼選它
渲染速度層級:TURBO、BALANCED、QUALITY
Ideogram
面向角色一致性的選項,可把一張已核准的角色圖片延展到新場景、服裝和格式。當角色識別特徵比廣泛圖片編輯更重要,且一次只需要一張輸出圖片時使用它。 每張圖 TURBO 12 / BALANCED 18 / QUALITY 24 點數. 可選 1–4 張輸出。總價按單張價格乘以所選張數計算,並向上取整為整數點數。
為什麼選它
以單張參考圖為核心,專為讓一個角色在新場景中保持可辨識而調整
ByteDance
Seedream 5.0 Pro 是 Rivya 的多參考圖圖片模型,適合製作行銷活動主畫面、編輯企劃場景與商品構圖。它支援文字轉圖片、圖片轉圖片、1K 或 2K 輸出,以及最多 10 張參考圖片。
為什麼選它
同一模型頁同時支援文字轉圖片與圖片轉圖片
ByteDance
Seedream 5.0 Pro 圖層拆解可將一張來源圖片分離為底圖與可重複使用的 PNG 圖層,並支援選用提示詞或邊界框引導,以及自動、1K、1.5K 或 2K 尺寸。
為什麼選它
專用的圖片轉圖層工作流程,而非一般圖片編輯
Nano Banana 2 Lite 是 Rivya 點數較低的 Nano Banana 選項,適合快速製作商品概念、社群圖片變體與參考圖引導的草稿。每次生成固定為 3 點數,並提供 15 種長寬比。
為什麼選它
每次生成固定為 3 點數
Alibaba
Qwen Image 3.0 是 Rivya 可靈活設定的 Qwen 圖片模型,適合中文或英文提示詞、參考圖引導的版面,以及可重現的視覺測試。它提供 1K 或 2K 輸出、提示詞擴寫、負面提示詞與隨機種子控制。
為什麼選它
支援中文與英文提示詞
Alibaba
Qwen Image 3.0 Pro 是 Rivya 獨立的 Pro 級 Qwen 圖片模型,適合精緻的行銷活動主視覺、商品場景與海報概念。它支援中文或英文提示詞、最多三張參考圖,以及分開計價的 1K 與 2K 點數級別。
為什麼選它
獨立 Pro 模型,1K 與 2K 採用不同點數級別
Grok Imagine Image 2.0 支援從文字生成單張圖片,以及使用一至五張具簽章的參考圖片進行標準圖片編輯。編輯請求可選用五種固定長寬比或自動長寬比。
為什麼選它
同一模型同時支援文字生成圖片與標準圖片編輯
ByteDance
字節跳動完整的 Seedance 2.0 影片模型,支援純文字生成、畫面引導動畫和多模態參考生成。Rivya 清楚區分各種輸入方式,讓首幀與尾幀和多模態參考素材各自發揮明確作用。
為什麼選它
支援文字、畫面和多模態參考三種起始方式
ByteDance
字節跳動更快的 Seedance 2.0 影片模型,可從純文字、首幀與尾幀,或多模態參考素材開始生成。Rivya 清楚區分各種輸入規則,避免首幀與尾幀和參考圖片、影片或音訊的用途混淆。
為什麼選它
支援文字、畫面和多模態參考三種起始方式
ByteDance
Seedance 影片模型,支援文字轉影片和圖片轉影片,並具備原生音畫同步。它支援 480p 至 1080p、4 至 12 秒片段、6 種長寬比、動態或固定鏡頭控制、可選音訊生成,以及唇形同步。
為什麼選它
原生音畫同步,具備精準唇形同步
ByteDance
此請求暫時無法使用,請稍後重試。
ByteDance
此請求暫時無法使用,請稍後重試。
ByteDance
此請求暫時無法使用,請稍後重試。
HappyHorse
HappyHorse 1.0 在 Rivya 的同一模型頁中支援文字生成影片、單圖生成影片與多圖參考影片。
為什麼選它
目前可呼叫範圍包括純提示詞影片、單圖影片,以及使用 2 到 9 張圖片的參考影片。
Alibaba
Wan 2.7 Video: 720p = 16 credits/s; 1080p = 24 credits/s; text/image: integer 2–15 s; video edit: duration=0 or integer 2–10 s; nsfw_checker=true.
為什麼選它
按解析度與時長計費:720p = 16 點數/秒,1080p = 24 點數/秒: 720p = 16 credits/s; 1080p = 24 credits/s.
Alibaba
Wan 2.6 支援不附媒體的文字生成影片、恰好 1 張圖片的圖片生成影片,以及使用 1–3 個影片的影片編輯;圖片與影片不可混用。 文字與圖片輸入支援 5、10 或 15 秒;影片輸入只支援 5 或 10 秒。
為什麼選它
三種模式:文字轉影片 + 圖片轉影片 + 影片轉影片
Alibaba
Wan 2.5 目前在 Rivya 上作為文字轉影片和圖片轉影片的共用入口。現行價格為 `720p_5 = 60`、`720p_10 = 120`、`1080p_5 = 100`、`1080p_10 = 200` 點數。
為什麼選它
一個模型同時支援文字轉影片和圖片轉影片
Alibaba
Wan 2.2 A14B Turbo 支援文字轉影片、圖片轉影片和圖片+音訊驅動影片。文字/圖片生成固定為 5 秒,價格為 `480p = 40`、`580p = 60`、`720p = 80`;圖片+音訊按輸出秒計費,價格為 `480p = 12`、`580p = 18`、`720p = 24`。
為什麼選它
一個模型同時涵蓋文字、圖片和圖片加音訊驅動影片生成
Alibaba
當來源片段已經有正確動作和構圖,只需要更換可見主體時,請選 Wan Animate Replace。當整個鏡頭需要重新想像時,回到提示詞驅動生成;如果要做的不只主體替換,則使用更廣泛的編輯專案。
為什麼選它
`1 video + 1 image`; `480p / 580p / 720p`.
MiniMax
MiniMax 的圖片轉影片模型,具備 Standard/Pro 品質層級、768P/1080P 解析度,以及 6 秒或 10 秒短片。適合從靜態圖片生成更順暢的動作和自然轉場。
為什麼選它
Standard 與 Pro 品質層級
MiniMax
MiniMax 較舊的 Hailuo Pro 影片模型在這裡以固定 Pro 層級接入,同時支援文字轉影片和圖片轉影片。圖片模式接受 1 或 2 張參考圖片,第二張圖片會作為尾幀使用,目前每次生成消耗 57 點數。 Fixed output: 1080P · 6s · 57 credits.
為什麼選它
同一模型支援文字轉影片和圖片轉影片
MiniMax
MiniMax 較舊的 Hailuo Standard 影片模型,在這裡統一作為同時支援文字轉影片和圖片轉影片的一個模型。圖片模式接受 1 或 2 張參考圖片,第二張圖片會作為尾幀使用,目前已驗證的公開價格層級為 12 到 50 點數。
為什麼選它
同一模型支援文字轉影片和圖片轉影片
Kuaishou
快手的高階影片模型,支援文字轉影片與圖片轉影片,提供 Standard (720P)、Pro (1080P) 與 4K 級別、單鏡頭或多鏡頭結構、3-15 秒時長、可選音訊生成,以及最多 2 張參考圖。
為什麼選它
Standard (720P)、Pro (1080P) 與 4K 品質級別
Kuaishou
明確的 1 張圖片 + 1 段動作影片專案,讓身份和動作角色保持清楚 Standard (720P) 20 × 經驗證動作影片秒數;Pro (1080P) 27 × 秒數
為什麼選它
明確的 1 張圖片 + 1 段動作影片專案,讓身份和動作角色保持清楚
Kuaishou
快手的影片模型,支援可選音訊生成、5 秒 / 10 秒片段和 3 種長寬比。擅長人物動作和富有表現力的角色動畫,並具備自然的物理效果。
為什麼選它
可選擇隨影片生成音訊
Kuaishou
這是專為動作遷移設計的專案,可用一張參考圖加一段動作影片驅動單一主體。當你想用較低成本完成 Kling motion-control 測試,且不需要 Kling 3.0 motion-control 額外的場景控制時,適合使用它。
為什麼選它
明確的 1 張圖片 + 1 段動作影片專案,因此身份來源和動作來源都很清楚
Kuaishou
快手的 Kling V2.5 Turbo Pro 影片模型,現在同時支援文字轉影片和圖片轉影片。公開價格證據清楚涵蓋文字和圖片兩種 5 秒與 10 秒級別,因此 Rivya 直接映射為 42 / 84 點數。
為什麼選它
文字和圖片級別都有清楚的公開價格證據
Kuaishou
快手較舊的 Kling V2.1 Master 影片模型現在在 Rivya 上同時支援文生影片和圖生影片。目前價格為 5 秒 160 點數,10 秒 320 點數。
為什麼選它
固定的 5 秒和 10 秒價格級別
Kuaishou
快手較舊的 Kling V2.1 Pro 圖生影片模型支援首幀加可選尾幀圖片。目前價格為 5 秒 50 點數,10 秒 100 點數。
為什麼選它
僅限圖生影片,專案範圍更窄
Kuaishou
快手較舊的 Kling V2.1 Standard 圖生影片模型。目前價格為 5 秒 25 點數,10 秒 50 點數。
為什麼選它
僅限圖生影片
Kuaishou
快手的 Kling AI Avatar Pro 高品質說話頭像模型,使用一張人物肖像加一段音訊生成口型同步的頭像影片。Rivya 依已驗證音訊時長以每秒 16 點數計價,最長 300 秒,總點數向上取整。
為什麼選它
固定的人物肖像加音訊高品質說話頭像專案
Kuaishou
快手的 Kling AI Avatar Standard 說話頭像模型,使用一張人物肖像加一段音訊生成口型同步的頭像影片。Rivya 依已驗證音訊時長以每秒 8 點數計價,最長 300 秒,總點數向上取整。
為什麼選它
固定的人物肖像加音訊說話頭像專案
MeiGen-AI
Infinitalk 是一款以人物肖像和音訊驅動的說話影片模型。目前費用按解析度和音訊時長計算:480p = 每秒 3 點數,720p = 每秒 12 點數。
為什麼選它
固定的人物肖像加音訊說話影片專案
Runway
Runway 是一個獨立影片模型,同時支援文字轉影片和圖片轉影片。公開價格證據目前只確認 3 個生成級別,因此 Rivya 保持在已驗證集合:`720p_5 = 12`、`720p_10 = 30`、`1080p_5 = 30`。
為什麼選它
文字和圖片級別都有清楚的公開價格證據
Runway
面向來源影片轉換的專案,可將既有片段改寫成新的視覺結果。當動作來自你的輸入素材、創意方向由提示詞決定,且需要固定 90 點數價格時,請使用 Aleph。
為什麼選它
圍繞一段來源影片建立,因此動作基礎來自你的素材,而不是空白生成
此請求暫時無法使用,請稍後重試。
Grok Imagine Video 1.5 Preview 支援 1~15 秒、480p 或 720p、最多 7 張參考圖片,以及最長 4096 字元的提示詞。
為什麼選它
目前的 Grok Imagine Video 1.5 Preview 合約
OpenAI
此請求暫時無法使用,請稍後重試。
OpenAI
此請求暫時無法使用,請稍後重試。
OpenAI
此請求暫時無法使用,請稍後重試。
Topaz
僅接收 1 個已上傳影片,不使用提示詞;放大倍率為 1x、2x 或 4x,預設 2x。
為什麼選它
僅接收 1 個已上傳影片,不使用提示詞;放大倍率為 1x、2x 或 4x,預設 2x。
720p 扣 225 點數,1080p 扣 233 點數(232.5 無條件進位),4K 扣 285;Extend 扣 225,符合條件的 1080p/4K 結果操作扣 8/60。 音訊能力仍屬實驗性且不保證可用;交付前必須逐項人工檢查。 升解析度操作只接受本人成功的 720p 基礎任務或 Extend 結果;直接生成的 1080p/4K 結果不能再次處理。
為什麼選它
Rivya 上更高階的 Veo 輸出路徑
支援純文字、首尾影格與 1~3 張參考圖片生成,可直接選擇 720p/1080p/4K 和 4/6/8 秒。 音訊能力仍屬實驗性且不保證可用;交付前必須逐項人工檢查。
為什麼選它
支援純文字、首尾影格與 1~3 張參考圖片生成,可直接選擇 720p/1080p/4K 和 4/6/8 秒。 TEXT / FRAME / REFERENCE.
支援純文字、首尾影格與 1~3 張參考圖片生成,可直接選擇 720p/1080p/4K 和 4/6/8 秒。 音訊能力仍屬實驗性且不保證可用;交付前必須逐項人工檢查。
為什麼選它
支援純文字、首尾影格與 1~3 張參考圖片生成,可直接選擇 720p/1080p/4K 和 4/6/8 秒。 TEXT / FRAME / REFERENCE.
Alibaba
Wan 3.0 Video 將標準版與 Prime 層級、文字生成影片、首尾幀引導及已簽署的多模態參考整合於同一模型。它支援 480P、720P 或 1080P 輸出,可選明確的 2–30 秒片長或智慧片長,並可接收由圖片、影片和音訊組成的參考素材組合。
為什麼選它
標準版與 Prime 共用同一套場景及參數合約
Flux
Flux 3 出現在即將推出的影片目錄中,標籤為文字轉影片與圖片轉影片。Rivya 將本頁作為狀態參考,不承諾未發布的控制項或運作行為。
為什麼選它
查看 Flux 3 的影片目錄狀態;若現在需要創作,請改用已開放的圖片或影片模型。
Kuaishou
Kling 3.0 Turbo 是 Rivya 專注於 Kling 影片生成的模型,可依文字提示直接生成,或從一張靜態圖片製作動畫。兩種路徑都支援 720p 與 1080p 輸出,以及 3 至 15 秒的整數片長;畫面比例控制則僅供文字生成影片使用。
為什麼選它
清楚區分文字生成影片與單張圖片動畫
ByteDance
Seedance 2.0 Mini 是 Rivya 費率較低的多模態 Seedance 工作流程,支援純提示影片、首幀或首尾幀動畫,以及混合圖片、影片或音訊參考。480p 與 720p 層級涵蓋 4 至 15 秒輸出,同時讓三種輸入場景保持互斥。
為什麼選它
為文字、畫面引導和多模態參考明確劃分三種場景
ByteDance
Seedance 2.5 是 Rivya 規模較大的 Seedance 工作流程,支援純提示影片、首尾幀引導、多模態參考及影片引導轉換。相較 Mini,它新增 1080p 層級、最長 30 秒輸出、自動片長、MP4 或 MOV 輸出,以及大幅提高的圖片、影片和音訊參考容量。
為什麼選它
文字、畫面與參考場景皆支援 480p、720p 和 1080p 輸出
MiniMax
MiniMax H3 是 Rivya 的 768P 或 2K 影片模型,支援純提示生成、首尾幀動畫及多模態參考。參考路徑可混合圖片、MP4 或 MOV 短片,以及 MP3 或 WAV 音訊;積分公式則分別計入經驗證的輸入影片時間及超過前 5 張的圖片。
為什麼選它
除 768P 輸出外另有專屬 2K 層級
HappyHorse
HappyHorse 1.1 是彈性的 AI 影片模型,支援 720p 或 1080p 純提示短片、單張圖片動畫及多圖片參考影片,輸出片長為 3 至 15 秒。
為什麼選它
三種不同起點:純文字、一張首幀圖片,或 2 至 9 張參考圖片
官方合約仍有公開文件,但目前產品頁無法使用,登入後的價格目錄也沒有此模型的價格。因此,生成會在預留點數前關閉。
為什麼選它
官方合約仍有公開文件,但目前產品頁無法使用,登入後的價格目錄也沒有此模型的價格。因此,生成會在預留點數前關閉。 目前可用的影片替代模型: Seedance 2.5, MiniMax H3, HappyHorse 1.1.
ByteDance
OmniHuman 1.5 會將恰好一張肖像圖片與一段音訊轉為 720p 或 1080p 的音訊驅動角色影片,積分依經驗證的音訊片長計算。
為什麼選它
恰好一張肖像與一條音訊軌,讓工作流程保持專注
Volcengine
Volcengine Video Lip Sync 會使用一條目標人聲軌,替換一段現有影片中的說話演出,並提供 Lite 或 Basic 處理模式,積分依片長計算。 輸出為 25 FPS 的 MP4,片長跟隨目標音訊。
為什麼選它
恰好一段來源影片與一條目標音訊軌
Kuaishou
目前開放可完整驗證的單鏡頭文字生成,以及單張首幀或首尾幀兩圖生成。
為什麼選它
目前開放可完整驗證的單鏡頭文字生成,以及單張首幀或首尾幀兩圖生成。
Wan Animate 2 是 Coming Soon 的影片轉影片條目。公開角色動畫定位不構成 Rivya 可呼叫合同或定價。
為什麼選它
追蹤 Wan Animate 2 目前狀態並比較可用的動作轉移模型,不把行銷示例視為執行支援。
PixVerse
PixVerse V6 — 暫時無法使用. 這是暫時的定價與整合安全暫停,不是 Coming Soon。頁面保持可索引,但在完整價格合約穩定前,生成入口與可呼叫報價都保持關閉。
為什麼選它
PixVerse V6 — 這是暫時的定價與整合安全暫停,不是 Coming Soon。頁面保持可索引,但在完整價格合約穩定前,生成入口與可呼叫報價都保持關閉。
Alibaba
Wan 2.6 Flash / 暫時無法使用 — 這是暫時的定價與整合安全暫停,不是 Coming Soon。頁面保持可索引,但在完整價格合約穩定前,生成入口與可呼叫報價都保持關閉。
為什麼選它
Wan 2.6 Flash / 目前可用的影片替代模型 — 這是暫時的定價與整合安全暫停,不是 Coming Soon。頁面保持可索引,但在完整價格合約穩定前,生成入口與可呼叫報價都保持關閉。
Suno
Suno Music 是 Rivya 的文字轉音樂模型,可將一段簡短需求轉成有人聲或純音樂的第一版歌曲草稿。它保留固定 `12` 點數入口,並在音軌成功生成後提供 `Extend Music` 作為下一步。
為什麼選它
明確記錄每次生成固定 12 點數
Suno
Suno Sounds 是 Rivya 的輕量文字轉聲音模型,適合環境聲循環、背景音和短聲音草稿。它保留已記錄的固定價格:每次生成 `2.5` 點數,並允許成功結果繼續進入 `Vocal Separation`。
為什麼選它
明確記錄每次生成固定 2.5 點數
Suno
Suno Lyrics 是 Rivya 的歌詞生成模型,可將一個主題或情緒轉成歌曲文字,每次請求固定花費 `1` 點數。
為什麼選它
固定 1 點數的歌詞生成
ElevenLabs
ElevenLabs 在 Rivya 上的多說話者對白模型。它為角色式語音生成而設計,支援個別語音分配、穩定性控制,以及適合 Podcast、訪談和角色場景的對白節奏。
為什麼選它
多說話者對白生成
ElevenLabs
ElevenLabs 在 Rivya 上的快速文本轉語音模型。它提供低延遲語音生成,並可調整穩定性、相似度、風格和速度,適合快速製作旁白草稿與互動式 TTS 專案。
為什麼選它
最快的 ElevenLabs TTS,針對低延遲最佳化
ElevenLabs
ElevenLabs 在 Rivya 上的多語文本轉語音模型,支援約 30 種語言並可自動偵測。它更適合在地化、跨語言交付,以及更自然的多語 voiceover。
為什麼選它
自動偵測並生成約 30 種語言
ElevenLabs
此請求暫時無法使用,請稍後重試。
ElevenLabs
此請求暫時無法使用,請稍後重試。
Gemini 3.1 Flash TTS 已列出文字轉語音與對話轉語音能力,但 Rivya 目前暫時無法提供生成,因為在任務開始前,仍無法安全界定單次執行的最高音訊 token 成本。
為什麼選它
查看 Gemini 3.1 Flash TTS 已確認的語音範圍,規劃依說話者排序的對話,並比較目前可在 Rivya 使用的音訊模型。
Gemini 2.5 Pro TTS 已有文字轉語音與對話轉語音的公開資料,但 Rivya 會維持生成暫時停用,直到每種允許的腳本都能由安全的最高點數預留完整涵蓋。
為什麼選它
使用這個狀態頁評估 Gemini 2.5 Pro TTS 是否適合旁白與多角色腳本規劃,再改用目前可在 Rivya 使用的語音模型。