Seedance 2.0
ByteDance のフル機能版 Seedance 2.0 動画モデルです。プロンプトのみの生成、フレームを使うアニメーション、画像・動画・音声によるマルチモーダル参照生成に対応しています。開始・終了フレームと各参照素材は、用途に応じて別々に指定できます。
検討する理由
次のタスクに プロンプト、フレーム、または画像/動画/音声参照 が必要な場合に検討できます。
完成した音声トラックに合わせて人物、ペット、イラストのキャラクターを演じさせ、元の肖像をビジュアルの基準として保ちたい場合に OmniHuman 1.5 を使用できます。このページでは、人物識別、被写体検出、マスクによる被写体選択は利用できません。
出力例
OmniHuman 1.5
画像+音声から動画
出力例
OmniHuman 1.5
最適
対応
オンライン試用
結果
完成した音声トラックに合わせて人物、ペット、イラストのキャラクターを演じさせ、元の肖像をビジュアルの基準として保ちたい場合に OmniHuman 1.5 を使用できます。このページでは、人物識別、被写体検出、マスクによる被写体選択は利用できません。
まだ結果はありません。プロンプトを送信して実行を開始してください。
判断材料
判断材料
最適なタスク
タスクがこのような場合に使えます
確認データ
プロバイダー
ByteDance
カテゴリ
動画
機能
画像+音声から動画
クレジットモデル
per_input_second · default=27 · ⌈total⌉
入力経路
画像 1 枚 + 音声 1 件
プロンプト設定
最大 300 文字
OmniHuman 1.5 FAQ
OmniHuman 1.5 は、1 枚の肖像で被写体を示し、1 つの音声トラックで演技を動かす、用途を絞った画像・音声ワークフロー向けです。一般的なプロンプトからの動画生成より、プレゼンター映像、キャラクターナレーション、話す被写体の短い動画に適しています。
10 MB 以下の JPEG、PNG、WebP 画像をちょうど 1 枚と、10 MB 以下の MP3、M4A、WAV、AAC、OGG 音声ファイルを 1 個アップロードします。検証済みの音声時間は 0 秒より長く、厳密に 60 秒未満でなければなりません。
Rivya は検証済み音声 1 秒あたり 27 クレジットで計算します。小数の再生時間を計算全体に反映し、予約合計だけを整数クレジットに切り上げます。報告された実使用量が有効で予約量以下の場合は、その実使用量で精算します。実使用量が欠落、無効、または予約量を超えている場合は、見えない追加請求を行わず照合対象として扱います。
高速モードは、品質に差が生じる可能性と引き換えに処理時間の短縮を優先します。品質を優先する場合はオフのままにし、初期テストで所要時間を重視する場合はオンにしてください。
はい。ただし任意で、Rivya では 300 文字以内です。現在のプロンプト経路は、中国語、英語、日本語、韓国語、スペイン語、インドネシア語のテキストだけを受け付けます。肖像と音声は引き続き必須入力です。
肖像画像をちょうど 1 枚、音声クリップを 1 個使って、音声で動くキャラクター動画を作成できます。被写体には人物、ペット、イラストのキャラクターを使用でき、720p または 1080p で出力できます。
維持したい被写体が明確に写った肖像を選び、完成版の音声を準備します。音声は 60 秒未満で、両方のファイルが生成前のアップロードチェックに合格する必要があります。
720p または 1080p を選び、高速処理を使うか決めます。比較条件を再現しやすくする必要がなければ、seed はランダム結果を得る -1 のままにしてください。
詳細は公開されていますが、アップロードと生成にはサインインが必要です。OmniHuman 1.5 は検証済み音声 1 秒あたり 27 クレジットで、最終的な計算合計だけを切り上げます。
1 枚の肖像と 1 つの音声トラックを試すときはこのページを使用します。テイクを保存したい場合、複数のキャラクターや音声バージョンを扱いたい場合、または制作を継続したい場合は Studio を開いてください。
代替モデルを比較
ByteDance のフル機能版 Seedance 2.0 動画モデルです。プロンプトのみの生成、フレームを使うアニメーション、画像・動画・音声によるマルチモーダル参照生成に対応しています。開始・終了フレームと各参照素材は、用途に応じて別々に指定できます。
検討する理由
次のタスクに プロンプト、フレーム、または画像/動画/音声参照 が必要な場合に検討できます。
ByteDance の高速な Seedance 2.0 動画モデルです。プロンプトのみの生成、開始・終了フレームを使う画像アニメーション、画像・動画・音声によるマルチモーダル参照生成に対応しています。
検討する理由
次のタスクに プロンプト、フレーム、または画像/動画/音声参照 が必要な場合に検討できます。
テキストから動画と画像から動画に対応し、音声と映像をネイティブに同期できる Seedance 動画モデルです。480p〜1080p、4〜12 秒のクリップ、6 種類のアスペクト比、動的または固定レンズ、任意の音声生成、リップシンクに対応しています。
検討する理由
次のタスクに プロンプト + 任意の画像 が必要な場合に検討できます。