Gunakan OmniHuman 1.5 saat seseorang, hewan peliharaan, atau karakter ilustrasi harus tampil mengikuti trek suara akhir sementara potret sumber tetap menjadi jangkar visual. Identifikasi manusia, deteksi subjek, dan pemilihan berbasis mask tidak tersedia di halaman ini.
Tepat satu gambar potret dan satu trek audio menjaga alur tetap terfokusBerfungsi untuk manusia, hewan peliharaan, dan subjek ilustrasi atau bergaya anime
Periksa input, output, kredit, dan contoh hasil, lalu coba model ini langsung di halaman. Masuk ke Studio saat Anda membutuhkan riwayat tersimpan, aset, atau iterasi yang lebih panjang.
Contoh output
OmniHuman 1.5
Paling cocok untuk
Video presenter berbasis trek suara akhirPenampilan karakter pendek dari satu potret yang disetujuiKlip hewan atau karakter ilustrasi yang berbicaraVideo sosial dan penjelasan berbasis narasi
Mendukung
Gambar + Audio ke Video
Uji coba online
Coba OmniHuman 1.5
Unggah satu potret dan satu klip audio kurang dari 60 detik, lalu pilih resolusi output, mode pemrosesan, dan seed opsional.
Hasil
OmniHuman 1.5
ByteDanceAI.generator.modes.image-audio-to-video
Gunakan OmniHuman 1.5 saat seseorang, hewan peliharaan, atau karakter ilustrasi harus tampil mengikuti trek suara akhir sementara potret sumber tetap menjadi jangkar visual. Identifikasi manusia, deteksi subjek, dan pemilihan berbasis mask tidak tersedia di halaman ini.
OmniHuman 1.5
Belum ada hasil. Kirim prompt untuk memulai proses.
Gambar + Audio ke Video
Kecocokan keputusan
Kapan model ini menjadi pilihan tepat
Kecocokan keputusan
Sinyal kecocokan
Tepat satu gambar potret dan satu trek audio menjaga alur tetap terfokus
Berfungsi untuk manusia, hewan peliharaan, dan subjek ilustrasi atau bergaya anime
Output 720p dan 1080p yang dapat dipilih
Mode pemrosesan lebih cepat opsional
Kredit mengikuti durasi audio terverifikasi
Tugas yang paling sesuai
Gunakan saat tugasnya terlihat seperti ini
Video presenter berbasis trek suara akhirPenampilan karakter pendek dari satu potret yang disetujuiKlip hewan atau karakter ilustrasi yang berbicaraVideo sosial dan penjelasan berbasis narasi
Fakta ringkas
Input, output, dan kredit yang perlu dikonfirmasi
Penyedia
ByteDance
Kategori
Video
Kemampuan
Gambar + Audio ke Video
Model kredit
per_input_second · default=27 · ⌈total⌉
Jalur input
1 gambar + 1 audio
Pengaturan prompt
Hingga 300 karakter
FAQ
FAQ OmniHuman 1.5
Untuk apa OmniHuman 1.5 paling cocok digunakan?
OmniHuman 1.5 dirancang untuk alur gambar-dan-audio terfokus: satu potret menyediakan subjek dan satu trek suara mengarahkan penampilan. Model ini lebih cocok untuk klip presenter, narasi karakter, dan video subjek berbicara pendek daripada tugas prompt-ke-video umum, tetapi tidak menjamin sinkronisasi bibir yang mutlak.
Berkas potret dan audio apa yang dapat saya unggah?
Unggah tepat satu gambar JPEG, PNG, atau WebP hingga 10 MB dan satu berkas audio MP3, M4A, WAV, AAC, atau OGG hingga 10 MB. Durasi audio terverifikasi harus lebih besar dari nol dan benar-benar kurang dari 60 detik.
Bagaimana kredit OmniHuman 1.5 dihitung?
Rivya menggunakan tarif 27 kredit per detik audio terverifikasi. Durasi desimal tetap menjadi bagian dari perhitungan penuh dan hanya total cadangan yang dibulatkan ke atas menjadi kredit bulat. Hanya jika penggunaan aktual yang dilaporkan valid dan tidak melebihi cadangan, Rivya menyelesaikan biaya sesuai penggunaan tersebut dan mengembalikan selisihnya; penggunaan yang hilang, tidak valid, atau melebihi cadangan masuk rekonsiliasi tanpa potongan tambahan tersembunyi.
Apa yang diubah mode cepat?
Mode cepat memprioritaskan waktu pemrosesan lebih singkat dengan kemungkinan kompromi kualitas. Biarkan nonaktif untuk proses yang mengutamakan kualitas, dan aktifkan jika kecepatan lebih penting dalam uji awal.
Bisakah saya menambahkan prompt ke potret dan audio?
Ya, tetapi bersifat opsional dan dibatasi 300 karakter di Rivya. Jalur prompt saat ini hanya menerima teks tertulis dalam bahasa Mandarin, Inggris, Jepang, Korea, Spanyol, atau Indonesia; potret dan audio tetap wajib.
Apa yang dapat saya buat di halaman OmniHuman 1.5 ini?
Buat video karakter berbasis audio dari tepat satu gambar potret dan satu klip audio. Subjek dapat berupa manusia, hewan peliharaan, atau karakter ilustrasi, dan output dapat berupa 720p atau 1080p.
Apa yang harus disiapkan sebelum membuat?
Pilih potret jelas yang sudah mewakili subjek, lalu siapkan rekaman suara akhir. Audio harus kurang dari 60 detik dan kedua berkas harus lolos pemeriksaan unggahan sebelum pembuatan.
Pengaturan mana yang paling penting?
Pilih 720p atau 1080p, tentukan apakah memakai pemrosesan lebih cepat, dan biarkan seed pada -1 untuk hasil acak kecuali memerlukan perbandingan lebih dapat diulang.
Apakah saya harus masuk, dan bagaimana kredit bekerja?
Detailnya publik, tetapi mengunggah dan membuat memerlukan login. OmniHuman 1.5 berbiaya 27 kredit per detik audio terverifikasi, dengan hanya total akhir yang dibulatkan ke atas.
Kapan saya sebaiknya membuka Studio lengkap?
Tetap di sini untuk menguji satu potret dan satu trek suara. Buka Studio untuk pengambilan tersimpan, beberapa karakter, versi suara berulang, atau alur produksi lebih panjang.
Bandingkan alternatif
Model lain yang layak dipertimbangkan berikutnya
Video
Seedance 2.0
Model video Seedance 2.0 lengkap dari ByteDance dengan dukungan eksplisit untuk pembuatan hanya dari prompt, animasi berbasis frame, dan pembuatan referensi multimodal. Rivya menjaga pemisahan peran terdokumentasi tetap eksplisit agar input frame dan referensi multimodal tetap saling eksklusif, bukan melebur menjadi satu wadah unggahan yang ambigu.
Mengapa dipertimbangkan
Pertimbangkan saat tugas berikutnya membutuhkan Prompt, frame, atau referensi gambar/video/audio.
InputPrompt, frame, atau referensi gambar/video/audio
Model video Seedance 2.0 yang lebih cepat dari ByteDance dengan pemilahan scene lengkap untuk pembuatan hanya dari prompt, animasi gambar berbasis frame, dan pembuatan video referensi multimodal. Rivya menjaga pembagian scene terdokumentasi tetap eksplisit agar input frame pertama/terakhir tidak bertabrakan dengan peran gambar, video, dan audio referensi.
Mengapa dipertimbangkan
Pertimbangkan saat tugas berikutnya membutuhkan Prompt, frame, atau referensi gambar/video/audio.
InputPrompt, frame, atau referensi gambar/video/audio
Paling cocok untukPra-visualisasi iklan cepat dari prompt atau frame storyboard
Video
Seedance 1.5 Pro
Model video Seedance untuk teks-ke-video dan gambar-ke-video dengan sinkronisasi audio-visual bawaan. Model ini mendukung klip 480p-1080p berdurasi 4-12 detik, 6 rasio aspek, kontrol lensa dinamis atau tetap, pembuatan audio opsional, dan sinkronisasi bibir.
Mengapa dipertimbangkan
Pertimbangkan saat tugas berikutnya membutuhkan Prompt + gambar opsional.