
孤獨機器人山巔影片預覽,展示寬幅山峰、受控運鏡、主體連續性、環境尺度和最終主視覺畫面。
影片簡報:山巔開場 / 機器人揭示 / 緩慢運鏡 / 環境連續性 / 主視覺結尾 / 品質檢查
Wan 2.2 A14B Turbo 在 Rivya 上支援三種起始方式:文字、一張圖片,或一張圖片加一段音訊來製作音訊驅動影片。它適合較輕量的 Wan 測試、圖片引導短片,以及由所提供音訊帶動的人像動態。

範例輸出
孤獨機器人山巔影片簡報預覽,聚焦寬幅開場、緩慢鏡頭路徑、環境連續性、可編輯細節和最終主視覺畫面。
文字轉影片 · 圖片轉影片

範例輸出
孤獨機器人山巔影片簡報預覽,聚焦寬幅開場、緩慢鏡頭路徑、環境連續性、可編輯細節和最終主視覺畫面。
最適合
支援
線上試用
結果
Wan 2.2 A14B Turbo 在 Rivya 上支援三種起始方式:文字、一張圖片,或一張圖片加一段音訊來製作音訊驅動影片。它適合較輕量的 Wan 測試、圖片引導短片,以及由所提供音訊帶動的人像動態。
目前還沒有結果。提交提示詞即可開始一次任務。
提示詞起步
不想從空白提示開始時,可使用已映射到 Wan 2.2 A14B Turbo 的模板,讓第一次執行更穩。
模型證明
先使用上方線上試用,再對照這些範例結果判斷完成度、節奏和任務適配度,之後再決定是否在 Studio 消耗更多點數。
主要範例
孤獨機器人山巔影片預覽,展示寬幅山峰、受控運鏡、主體連續性、環境尺度和最終主視覺畫面。
輸入
提示詞、1 張圖片,或 1 張圖片 + 1 段音訊
觀察重點
孤獨機器人山巔影片預覽,展示寬幅山峰、受控運鏡、主體連續性、環境尺度和最終主視覺畫面。
每次使用點數
per_output_second · 480p_standard_5s=40 · 580p_standard_5s=60 · 720p_standard_5s=80 · 480p_speech=12 · 580p_speech=18 · 720p_speech=24 · ⌈total⌉
為什麼這個模型有效
一個模型同時涵蓋文字、圖片和圖片加音訊驅動影片生成
點數級別區分較輕的文字或圖片生成,以及較重的音訊驅動生成
圖片加音訊驅動方式提供專用的進階控制項
最適合的任務
模型證明
決策適配
決策適配
Wan 2.2 A14B Turbo 常見問題
Wan 2.2 A14B Turbo 適合較輕量的文字轉影片測試、從一張圖片製作短片,或用一張靜態圖片加一個音訊檔帶動人像動態。當你想在同一個模型中使用這三種起始方式,並讓較輕與音訊驅動生成採不同點數級別時,它很實用。
在 Rivya 上,Wan 2.2 A14B Turbo 目前支援文字轉影片、圖片轉影片,以及圖片 + 音訊驅動。它也可以在圖片輸入和音訊輸入之間使用最多 2 個參考檔案。
選擇 480p、580p 或 720p,設定畫面比例,並決定從文字、一張圖片,或圖片加音訊開始。製作音訊驅動的人像動態時,靜態圖與音訊本身必須已經能形成可信的組合。
文字/圖片生成固定為 5 秒,480p/580p/720p 分別為 40/60/80 點數。圖片+音訊在相同解析度下按輸出秒計費,分別為 12/18/24 點數。
當你需要在一個模型中進行文字、圖片和圖片加音訊影片生成時,請選 Wan 2.2 A14B Turbo。如果只需基本的文字或圖片測試,請先比較用途更聚焦、成本更低的選項。
當第一次執行是為了較輕量的 Wan 文字轉影片實驗、從一張圖片生成短片,或用一張靜態圖片加一個音訊檔製作音訊驅動人像片段時,可以從這裡開始。這能讓第一次執行保持務實:先在這裡檢查輸入、方向和輸出品質,再把它變成更長專案。
這個頁面目前支援文字轉影片、圖片轉影片,以及圖片 + 音訊驅動。這讓你更容易判斷純鏡頭描述或靜態圖起步,哪一種更適合較輕量的 Wan 文字轉影片實驗。你也可以在圖片輸入和音訊輸入之間帶入最多 2 個參考檔案。
執行前,主要檢查是 480p、580p、720p 這類輸出級別、畫面比例和提示詞引導。這些通常會決定第一個結果是否足夠接近,讓你能繼續在這裡朝較輕量的 Wan 文字轉影片實驗迭代,而不必把設定變得過重。
頁面可公開瀏覽,但生成影片前需要登入。文字/圖片生成固定 5 秒,480p/580p/720p 為 40/60/80 點數;圖片+音訊按輸出秒計費,為 12/18/24 點數。
當你仍在驗證第一個鏡頭、來源類型,以及第一個結果是否接近 Wan 2.2 A14B Turbo 上較輕量的 Wan 文字轉影片實驗時,可以留在這個頁面。當工作需要儲存版本、重複片段迭代、多個素材,或圍繞同一場景組展開更長製作流程時,再開啟完整 Studio。
比較替代模型
字節跳動完整的 Seedance 2.0 影片模型,支援純文字生成、畫面引導動畫和多模態參考生成。Rivya 清楚區分各種輸入方式,讓首幀與尾幀和多模態參考素材各自發揮明確作用。
為什麼考慮它
如果下一個任務需要 提示詞、影格,或圖片/影片/音訊參考,可以考慮它。
字節跳動更快的 Seedance 2.0 影片模型,可從純文字、首幀與尾幀,或多模態參考素材開始生成。Rivya 清楚區分各種輸入規則,避免首幀與尾幀和參考圖片、影片或音訊的用途混淆。
為什麼考慮它
如果下一個任務需要 提示詞、影格,或圖片/影片/音訊參考,可以考慮它。
Seedance 影片模型,支援文字轉影片和圖片轉影片,並具備原生音畫同步。它支援 480p 至 1080p、4 至 12 秒片段、6 種長寬比、動態或固定鏡頭控制、可選音訊生成,以及唇形同步。
為什麼考慮它
如果下一個任務需要 提示詞 + 可選圖片,可以考慮它。
最適合的任務
任務接近這些情境時使用
安靜事實
提供方
Alibaba
類別
影片
能力
文字轉影片 · 圖片轉影片 · 圖片 + 音訊驅動
點數模式
per_output_second · 480p_standard_5s=40 · 580p_standard_5s=60 · 720p_standard_5s=80 · 480p_speech=12 · 580p_speech=18 · 720p_speech=24 · ⌈total⌉
輸入路徑
提示詞、1 張圖片,或 1 張圖片 + 1 段音訊
提示設定
最多 5,000 個字元
開發者存取
Wan 2.2 A14B Turbo 已有可呼叫的 Public API 模式,但參考媒體模式仍需要 Files API 上傳支援。提交前請先查看模型參考。