Seedance 2.0
字節跳動完整的 Seedance 2.0 影片模型,支援純文字生成、畫面引導動畫和多模態參考生成。Rivya 清楚區分各種輸入方式,讓首幀與尾幀和多模態參考素材各自發揮明確作用。
為什麼考慮它
如果下一個任務需要 提示詞、影格,或圖片/影片/音訊參考,可以考慮它。
當人物、寵物或插畫角色需要依完成的語音軌演出,同時讓來源肖像保持為視覺錨點時,可使用 OmniHuman 1.5。本頁目前不提供人物識別、主體偵測或以遮罩選擇主體。
範例輸出
OmniHuman 1.5
圖片+音訊轉影片
範例輸出
OmniHuman 1.5
最適合
支援
線上試用
結果
當人物、寵物或插畫角色需要依完成的語音軌演出,同時讓來源肖像保持為視覺錨點時,可使用 OmniHuman 1.5。本頁目前不提供人物識別、主體偵測或以遮罩選擇主體。
目前還沒有結果。提交提示詞即可開始一次任務。
決策適配
決策適配
最適合的任務
任務接近這些情境時使用
安靜事實
提供方
ByteDance
類別
影片
能力
圖片+音訊轉影片
點數模式
per_input_second · default=27 · ⌈total⌉
輸入路徑
1 張圖片 + 1 段音訊
提示設定
最多 300 個字元
OmniHuman 1.5 常見問題
OmniHuman 1.5 專為聚焦的圖片加音訊工作流程設計:一張肖像提供主體,一段語音軌驅動最終演出。相較一般的提示詞生成影片任務,它更適合簡報者短片、角色旁白及短篇說話主體影片。
上傳恰好一張不超過 10 MB 的 JPEG、PNG 或 WebP 圖片,以及一個不超過 10 MB 的 MP3、M4A、WAV、AAC 或 OGG 音訊檔。經驗證的音訊片長必須大於 0 且嚴格小於 60 秒。
Rivya 依每個經驗證的音訊秒數收取 27 點積分。小數片長會完整納入計算,只有預留總額會向上取整為整數積分。只有回報的實際用量有效且不高於預留額時,Rivya 才按實際用量精算並退回差額;實際用量缺失、無效或高於預留額時會進入對帳,不會觸發未揭露的額外扣款。
快速模式會優先縮短處理時間,但可能犧牲部分品質。品質優先的執行請將它關閉;早期測試較重視周轉速度時則可開啟。
可以,但為可選項目,且在 Rivya 上最多 300 個字元。目前提示詞路徑只接受中文、英文、日文、韓文、西班牙文或印尼文;肖像與音訊仍是必填輸入。
從恰好一張肖像圖片與一段音訊建立音訊驅動角色影片。主體可以是人物、寵物或插畫角色,輸出可選 720p 或 1080p。
選擇一張已呈現預定主體的清楚肖像,再準備最終語音錄音。音訊必須短於 60 秒,兩個檔案都必須在生成前通過上傳檢查。
選擇 720p 或 1080p、決定是否使用較快速的處理選項;若不需要可重複的比較,seed 維持 -1 以取得隨機結果。
模型詳細資訊可公開瀏覽,但上傳和生成需要登入。OmniHuman 1.5 依每個經驗證的音訊秒數收取 27 點積分,只有最終計算總額會向上取整。
若只測試一張肖像和一段語音軌,可留在此頁面。需要儲存多次演出、數個角色、重複語音版本或更長製作流程時,請開啟 Studio。
比較替代模型
字節跳動完整的 Seedance 2.0 影片模型,支援純文字生成、畫面引導動畫和多模態參考生成。Rivya 清楚區分各種輸入方式,讓首幀與尾幀和多模態參考素材各自發揮明確作用。
為什麼考慮它
如果下一個任務需要 提示詞、影格,或圖片/影片/音訊參考,可以考慮它。
字節跳動更快的 Seedance 2.0 影片模型,可從純文字、首幀與尾幀,或多模態參考素材開始生成。Rivya 清楚區分各種輸入規則,避免首幀與尾幀和參考圖片、影片或音訊的用途混淆。
為什麼考慮它
如果下一個任務需要 提示詞、影格,或圖片/影片/音訊參考,可以考慮它。
Seedance 影片模型,支援文字轉影片和圖片轉影片,並具備原生音畫同步。它支援 480p 至 1080p、4 至 12 秒片段、6 種長寬比、動態或固定鏡頭控制、可選音訊生成,以及唇形同步。
為什麼考慮它
如果下一個任務需要 提示詞 + 可選圖片,可以考慮它。