OmniHuman 1.5Портретное видео под управлением аудио
Используйте OmniHuman 1.5, когда человек, питомец или нарисованный персонаж должен исполнять готовую голосовую дорожку, а исходный портрет остаётся визуальной основой. На этой странице недоступны идентификация людей, обнаружение объектов и выбор с помощью маски.
Ровно одно портретное изображение и одна аудиодорожка сохраняют сфокусированный процессРабота с людьми, питомцами и рисованными персонажами или героями в стиле аниме
Проверьте вход, выход, кредиты и пример результата, затем попробуйте модель прямо на странице. Переходите в Rivya Studio, когда нужны сохраненная история, материалы или более длинные итерации.
Пример результата
OmniHuman 1.5
Лучше всего для
Видео с ведущим под готовую голосовую дорожкуКороткие выступления персонажа по одному утверждённому портретуГоворящие ролики с питомцами или рисованными персонажамиСоциальные видео и объяснения на основе озвучивания
Поддерживает
Изображение + аудио в видео
Онлайн-тест
Попробуйте OmniHuman 1.5
Загрузите один портрет и один аудиофрагмент короче 60 секунд, затем выберите разрешение результата, режим обработки и необязательный seed.
Результаты
OmniHuman 1.5
ByteDanceAI.generator.modes.image-audio-to-video
Используйте OmniHuman 1.5, когда человек, питомец или нарисованный персонаж должен исполнять готовую голосовую дорожку, а исходный портрет остаётся визуальной основой. На этой странице недоступны идентификация людей, обнаружение объектов и выбор с помощью маски.
OmniHuman 1.5
Результата пока нет. Отправьте промпт, чтобы начать запуск.
Изображение + аудио в видео
Подходит для решения
Когда эта модель будет правильным выбором
Подходит для решения
Сигналы соответствия
Ровно одно портретное изображение и одна аудиодорожка сохраняют сфокусированный процесс
Работа с людьми, питомцами и рисованными персонажами или героями в стиле аниме
Выбор результата в 720p и 1080p
Необязательный ускоренный режим обработки
Кредиты зависят от проверенной длительности аудио
Лучшие задачи
Используйте ее, когда задача выглядит так
Видео с ведущим под готовую голосовую дорожкуКороткие выступления персонажа по одному утверждённому портретуГоворящие ролики с питомцами или рисованными персонажамиСоциальные видео и объяснения на основе озвучивания
Сухие факты
Проверьте вход, выход и кредиты
Провайдер
ByteDance
Категория
Видео
Возможности
Изображение + аудио в видео
Схема кредитов
per_input_second · default=27 · ⌈total⌉
Путь входа
1 изображение + 1 аудио
Настройка промпта
До 300 символов
Вопросы и ответы
Вопросы и ответы по OmniHuman 1.5
Для каких задач лучше всего подходит OmniHuman 1.5?
OmniHuman 1.5 создана для сфокусированного процесса с изображением и аудио: один портрет задаёт героя, а одна голосовая дорожка управляет его исполнением. Она лучше подходит для роликов с ведущим, повествования от лица персонажа и коротких видео с говорящим героем, чем для общего создания видео по промпту.
Какие файлы портрета и аудио можно загрузить?
Загрузите ровно одно изображение JPEG, PNG или WebP размером до 10 MB и один аудиофайл MP3, M4A, WAV, AAC или OGG размером до 10 MB. Проверенная длительность аудио должна быть больше нуля и строго меньше 60 секунд.
Как рассчитываются кредиты OmniHuman 1.5?
Rivya использует ставку 27 кредитов за проверенную секунду аудио. Дробная длительность сохраняется в полном расчёте, и вверх до целого кредита округляется только общий резерв. Если получены корректные данные о фактическом использовании, не превышающие резерв, Rivya рассчитывает списание по ним. Отсутствующие, некорректные или превышающие резерв данные передаются на сверку и не приводят к скрытому дополнительному списанию.
Что меняет быстрый режим?
Быстрый режим отдаёт приоритет меньшему времени обработки с возможным компромиссом в качестве. Оставьте его выключенным для запуска с приоритетом качества и включите, если на раннем тесте важнее скорость получения результата.
Можно ли добавить промпт к портрету и аудио?
Да, но он необязателен и ограничен 300 символами в Rivya. Текущий путь промпта принимает только текст на китайском, английском, японском, корейском, испанском или индонезийском языке; портрет и аудио остаются обязательными входными данными.
Что можно создать на этой странице OmniHuman 1.5?
Создайте видео персонажа под управлением аудио ровно из одного портретного изображения и одного аудиофрагмента. Героем может быть человек, питомец или рисованный персонаж, а результат — в 720p или 1080p.
Что подготовить до создания?
Выберите чёткий портрет, который уже передаёт нужный облик героя, затем подготовьте окончательную голосовую запись. Аудио должно быть короче 60 секунд, и оба файла должны пройти проверки загрузки до создания.
Какие настройки важнее всего?
Выберите 720p или 1080p, решите, нужен ли ускоренный режим обработки, и оставьте seed равным -1 для случайного результата, если не требуется более воспроизводимое сравнение.
Нужно ли входить в аккаунт и как работают кредиты?
Описание общедоступно, но для загрузки и создания нужен вход. OmniHuman 1.5 стоит 27 кредитов за проверенную секунду аудио, а вверх округляется только итоговая рассчитанная сумма.
Когда стоит открыть полную Studio?
Оставайтесь здесь для проверки одного портрета и одной голосовой дорожки. Откройте Studio, если нужны сохранённые дубли, несколько персонажей, повторные версии голоса или более длительный производственный процесс.
Сравнить альтернативы
Другие модели, которые стоит рассмотреть
Видео
Seedance 2.0
Полная видеомодель ByteDance Seedance 2.0 с явной поддержкой генерации только по промпту, кадровой анимации и мультимодальной reference-генерации. Rivya явно сохраняет документированное разделение ролей, чтобы кадровые входы и мультимодальные референсы оставались взаимоисключающими, а не сливались в один неоднозначный блок загрузки.
Почему рассмотреть
Рассмотрите ее, когда следующей задаче нужен вход: Промпт, кадры или референсы изображения/видео/аудио.
ВходПромпт, кадры или референсы изображения/видео/аудио
Более быстрая видеомодель ByteDance Seedance 2.0 с полным разделением сцен для генерации только по промпту, анимации изображения по кадрам и мультимодальной reference-to-video генерации. Rivya явно сохраняет документированное разделение сцен, чтобы входы первого/последнего кадра не смешивались с ролями референсного изображения, видео и аудио.
Почему рассмотреть
Рассмотрите ее, когда следующей задаче нужен вход: Промпт, кадры или референсы изображения/видео/аудио.
ВходПромпт, кадры или референсы изображения/видео/аудио
Лучше всего дляБыстрая предвизуализация рекламы из промптов или кадров сториборда
Видео
Seedance 1.5 Pro
Видеомодель Seedance для генерации по тексту и изображению с синхронизацией звука и видео. Она поддерживает разрешение от 480p до 1080p, клипы длительностью 4–12 секунд, шесть соотношений сторон, динамичную или фиксированную камеру, необязательную генерацию аудио и синхронизацию губ.