Використовуйте OmniHuman 1.5, коли людина, домашня тварина чи намальований персонаж має виконати завершену голосову доріжку, а вихідний портрет — залишитися візуальною основою. Ідентифікація людей, виявлення об’єктів і вибір за маскою на цій сторінці недоступні.
Рівно одне портретне зображення й одна аудіодоріжка зберігають процес зосередженимПрацює з людьми, домашніми тваринами та намальованими або аніме-персонажами
Вибір виходу 720p і 1080p
Вхідні дані
1 зображення + 1 аудіо
Вивід
AI-генератор відео
Кредити
per_input_second · default=27 · ⌈total⌉
Найкраще для
Відео ведучих під керуванням завершеної голосової доріжки
Перевірте вхідні дані, вивід, кредити й приклад результату, а потім спробуйте цю модель прямо на сторінці. Переходьте в Studio, коли потрібні збережена історія, асети або довша ітерація.
Приклад виводу
OmniHuman 1.5
Найкраще для
Відео ведучих під керуванням завершеної голосової доріжкиКороткі виступи персонажів з одного затвердженого портретаРозмовні кліпи з домашніми тваринами або намальованими персонажамиСоціальні відео й пояснення під керуванням дикторського тексту
Підтримує
Зображення + аудіо у відео
Онлайн-проба
Спробуйте OmniHuman 1.5
Завантажте один портрет і один аудіокліп тривалістю менш як 60 секунд, а потім виберіть роздільну здатність виходу, режим обробки й необов’язковий seed.
Результати
OmniHuman 1.5
ByteDanceAI.generator.modes.image-audio-to-video
Використовуйте OmniHuman 1.5, коли людина, домашня тварина чи намальований персонаж має виконати завершену голосову доріжку, а вихідний портрет — залишитися візуальною основою. Ідентифікація людей, виявлення об’єктів і вибір за маскою на цій сторінці недоступні.
OmniHuman 1.5
Результату ще немає. Надішліть промпт, щоб почати запуск.
Зображення + аудіо у відео
Відповідність рішенню
Коли ця модель є правильним вибором
Відповідність рішенню
Сигнали відповідності
Рівно одне портретне зображення й одна аудіодоріжка зберігають процес зосередженим
Працює з людьми, домашніми тваринами та намальованими або аніме-персонажами
Вибір виходу 720p і 1080p
Необов’язковий режим швидшої обробки
Кредити залежать від перевіреної тривалості аудіо
Найкращі задачі
Використовуйте її, коли задача виглядає так
Відео ведучих під керуванням завершеної голосової доріжкиКороткі виступи персонажів з одного затвердженого портретаРозмовні кліпи з домашніми тваринами або намальованими персонажамиСоціальні відео й пояснення під керуванням дикторського тексту
Стислі факти
Вхідні дані, вивід і кредити для перевірки
Провайдер
ByteDance
Категорія
Відео
Можливості
Зображення + аудіо у відео
Модель кредитів
per_input_second · default=27 · ⌈total⌉
Шлях вхідних даних
1 зображення + 1 аудіо
Налаштування промпта
До 300 символів
FAQ
OmniHuman 1.5 FAQ
Для чого найкраще використовувати OmniHuman 1.5?
OmniHuman 1.5 створено для зосередженого процесу із зображенням і аудіо: один портрет задає об’єкт, а одна голосова доріжка керує результатом. Вона краще підходить для кліпів ведучих, оповіді персонажів і коротких відео з мовцем, ніж для загальної генерації відео за промптом.
Які файли портрета й аудіо можна завантажити?
Завантажте рівно одне зображення JPEG, PNG або WebP розміром до 10 МБ і один аудіофайл MP3, M4A, WAV, AAC або OGG розміром до 10 МБ. Перевірена тривалість аудіо має бути більшою за нуль і строго меншою за 60 секунд.
Як розраховуються кредити OmniHuman 1.5?
Rivya застосовує ставку 27 кредитів за секунду перевіреного аудіо. Дробова тривалість входить до повного розрахунку, а до цілого кредита округлюється угору лише підсумок резерву. Коли повідомлене фактичне використання є коректним і не перевищує зарезервовану суму, Rivya проводить остаточний розрахунок за ним. Відсутні, некоректні або вищі за резерв дані залишаються на звірці й не спричиняють прихованого додаткового списання.
Що змінює швидкий режим?
Швидкий режим надає перевагу коротшому часу обробки з можливим компромісом у якості. Залиште його вимкненим для запуску з пріоритетом якості або ввімкніть, коли для раннього тесту важливіша швидкість.
Чи можна додати промпт до портрета й аудіо?
Так, але він необов’язковий і в Rivya обмежений 300 символами. Поточний шлях промпту приймає письмовий текст лише китайською, англійською, японською, корейською, іспанською або індонезійською мовою; портрет і аудіо залишаються обов’язковими входами.
Що можна створити на цій сторінці OmniHuman 1.5?
Створіть відео персонажа під керуванням аудіо з рівно одного портретного зображення й одного аудіокліпу. Об’єктом може бути людина, домашня тварина чи намальований персонаж, а вихід — 720p або 1080p.
Що слід підготувати до генерації?
Виберіть чіткий портрет, який уже відображає потрібний об’єкт, і підготуйте фінальний голосовий дубль. Аудіо має бути коротшим за 60 секунд, а обидва файли — пройти перевірки завантаження до генерації.
Які налаштування найважливіші?
Виберіть 720p або 1080p, вирішіть, чи використовувати швидшу обробку, і залиште seed на -1 для випадкового результату, якщо не потрібна відтворюваніша основа для порівняння.
Чи потрібно входити в акаунт і як працюють кредити?
Відомості доступні публічно, але для завантаження й генерації потрібно ввійти. OmniHuman 1.5 коштує 27 кредитів за секунду перевіреного аудіо, а угору округлюється лише фінальний розрахований підсумок.
Коли варто відкрити повну Studio?
Залишайтеся тут, щоб перевірити один портрет і одну голосову доріжку. Відкрийте Studio, коли потрібні збережені дублі, кілька персонажів, повторні версії голосу або довший виробничий процес.
Порівняти альтернативи
Інші моделі, які варто розглянути далі
Відео
Seedance 2.0
Повна відеомодель Seedance 2.0 від ByteDance з явною підтримкою генерації лише з prompt, анімації на основі кадрів і мультимодальної генерації за референсами. Rivya явно зберігає задокументований розподіл ролей, щоб кадрові входи й мультимодальні референси лишалися взаємовиключними, а не зливалися в один нечіткий upload-bucket.
Чому розглянути
Розгляньте її, коли наступна задача потребує Промпт, кадри або референси зображення/відео/аудіо.
Вхідні даніПромпт, кадри або референси зображення/відео/аудіо
Швидша відеомодель Seedance 2.0 від ByteDance з повним розподілом сцен для генерації лише з prompt, анімації зображень на основі кадрів і мультимодальної генерації відео за референсами. Rivya явно зберігає задокументований поділ сцен, щоб входи першого/останнього кадру не змішувалися з ролями референсних зображень, відео й аудіо.
Чому розглянути
Розгляньте її, коли наступна задача потребує Промпт, кадри або референси зображення/відео/аудіо.
Вхідні даніПромпт, кадри або референси зображення/відео/аудіо
Найкраще дляШвидкий previs реклами з prompt або storyboard-кадрів
Відео
Seedance 1.5 Pro
Відеомодель Seedance для генерації з тексту й зображення з вбудованою синхронізацією аудіо та відео. Вона підтримує 480p–1080p, кліпи тривалістю 4–12 секунд, 6 співвідношень сторін, динамічне або фіксоване керування об'єктивом, необов'язкову генерацію аудіо й синхронізацію губ.
Чому розглянути
Розгляньте її, коли наступна задача потребує Промпт + необов'язкові зображення.