Volcengine Video Lip SyncИИ-синхронизация губ в видео
Используйте Volcengine Video Lip Sync, когда в исходном материале уже подходят человек, кадрирование и движение, но движения рта должны следовать другой голосовой записи.
Ровно одно исходное видео и одна целевая аудиодорожкаРежим Lite для материала с одним человеком анфас
Режим Basic для более сложных сцен с одним человеком
Вход
До 2 референс-файлов
Выход
Генератор ИИ-видео
Кредиты
per_input_second · default=8 · ⌈total⌉
Лучше всего для
Переозвучивание одного ролика с ведущим новой голосовой дорожкой
Проверьте вход, выход, кредиты и пример результата, затем попробуйте модель прямо на странице. Переходите в Rivya Studio, когда нужны сохраненная история, материалы или более длинные итерации.
Пример результата
Volcengine Video Lip Sync
Лучше всего для
Переозвучивание одного ролика с ведущим новой голосовой дорожкойЛокализация существующих видео с одним говорящимИсправление диалога с сохранением утверждённого видеоматериалаСоциальные, учебные или представительские ролики с человеком анфас
Поддерживает
Видео + аудио в видео
Онлайн-тест
Попробуйте Volcengine Video Lip Sync
Загрузите одно поддерживаемое исходное видео и одну голосовую дорожку, затем выберите обработку Lite или Basic и только доступные для этого режима настройки.
Результаты
Volcengine Video Lip Sync
VolcengineAI.generator.modes.video-audio-to-video
Используйте Volcengine Video Lip Sync, когда в исходном материале уже подходят человек, кадрирование и движение, но движения рта должны следовать другой голосовой записи.
Volcengine Video Lip Sync
Результата пока нет. Отправьте промпт, чтобы начать запуск.
Видео + аудио в видео
Подходит для решения
Когда эта модель будет правильным выбором
Подходит для решения
Сигналы соответствия
Ровно одно исходное видео и одна целевая аудиодорожка
Режим Lite для материала с одним человеком анфас
Режим Basic для более сложных сцен с одним человеком
Необязательное отделение голоса и зависящие от режима настройки выравнивания
Кредиты и длительность результата следуют проверенной аудиодорожке
Лучшие задачи
Используйте ее, когда задача выглядит так
Переозвучивание одного ролика с ведущим новой голосовой дорожкойЛокализация существующих видео с одним говорящимИсправление диалога с сохранением утверждённого видеоматериалаСоциальные, учебные или представительские ролики с человеком анфас
Сухие факты
Проверьте вход, выход и кредиты
Провайдер
Volcengine
Категория
Видео
Возможности
Видео + аудио в видео
Схема кредитов
per_input_second · default=8 · ⌈total⌉
Путь входа
До 2 референс-файлов
Настройка промпта
Направляется промптом
Вопросы и ответы
Вопросы и ответы по Volcengine Video Lip Sync
Для каких задач лучше всего подходит Volcengine Video Lip Sync?
Используйте модель, когда исходное видео уже даёт нужный визуальный результат, а речевое исполнение должно следовать другой голосовой дорожке. Это процесс синхронизации губ по видео и аудио, а не генератор видео по промпту и не модель анимации портрета.
Какие файлы можно загрузить в Rivya?
Загрузите ровно одно видео MP4 или MOV размером до 95 MB и один аудиофайл MP3, M4A, WAV, AAC или OGG размером до 10 MB. Видео должно находиться в поддерживаемом диапазоне геометрии от 360p до 1080p, частоты от 24 до 60 fps и битрейта от 1 до 30 Mbps, а оба файла должны иметь положительную проверенную длительность.
Какой режим выбрать: Lite или Basic?
Выберите Lite для одного человека, смотрящего в камеру, когда полезны более быстрая обработка и настройки выравнивания аудио с видео. Выберите Basic для более сложной сцены с одним человеком, особенно если нужны сегментация сцен и определение говорящего.
Как работают настройки только для Lite?
В режиме Lite выравнивание аудио может зациклить видео, если целевое аудио длиннее. Обратное зацикливание доступно только при включённом выравнивании, а значение начала шаблона определяет, где начинается исходная последовательность. В режиме Basic эти настройки не используются.
Как рассчитываются кредиты?
Rivya использует ставку 8 кредитов за проверенную секунду аудио, а длительность результата следует этому аудио. Дробная длительность сохраняется в полном расчёте, и вверх до целого кредита округляется только общий резерв. Если получены корректные данные о фактическом использовании, не превышающие резерв, Rivya рассчитывает списание по ним. Отсутствующие, некорректные или превышающие резерв данные передаются на сверку и не приводят к скрытому дополнительному списанию.
Что можно сделать на этой странице синхронизации губ?
Объедините одно существующее видео с одним человеком и одну целевую голосовую дорожку, чтобы видимая речь следовала новому аудио, а исходный материал оставался визуальной основой.
Что проверить перед загрузкой?
Используйте поддерживаемый файл MP4 или MOV с хорошо видимым говорящим, затем подготовьте чистую голосовую дорожку. Убедитесь, что видео не превышает 95 MB, а его разрешение, частота кадров и битрейт входят в указанные пределы.
С какого режима начать?
Начните с Lite для простого материала с человеком анфас. Используйте Basic, если сцена сложнее или полезны сегментация сцен и определение говорящего.
Нужно ли входить в аккаунт и как работают кредиты?
Описание общедоступно, но для загрузки и создания нужен вход. Цена составляет 8 кредитов за проверенную секунду аудио, результат следует длительности аудио, а вверх округляется только итоговая рассчитанная сумма.
Когда стоит открыть полную Studio?
Оставайтесь здесь для проверки одного исходного видео и одной голосовой дорожки. Откройте Studio для сохранённых озвучек, повторных языков или дублей, сравнительной работы или более длительного процесса локализации.
Сравнить альтернативы
Другие модели, которые стоит рассмотреть
Видео
Seedance 2.0
Полная видеомодель ByteDance Seedance 2.0 с явной поддержкой генерации только по промпту, кадровой анимации и мультимодальной reference-генерации. Rivya явно сохраняет документированное разделение ролей, чтобы кадровые входы и мультимодальные референсы оставались взаимоисключающими, а не сливались в один неоднозначный блок загрузки.
Почему рассмотреть
Рассмотрите ее, когда следующей задаче нужен вход: Промпт, кадры или референсы изображения/видео/аудио.
ВходПромпт, кадры или референсы изображения/видео/аудио
Более быстрая видеомодель ByteDance Seedance 2.0 с полным разделением сцен для генерации только по промпту, анимации изображения по кадрам и мультимодальной reference-to-video генерации. Rivya явно сохраняет документированное разделение сцен, чтобы входы первого/последнего кадра не смешивались с ролями референсного изображения, видео и аудио.
Почему рассмотреть
Рассмотрите ее, когда следующей задаче нужен вход: Промпт, кадры или референсы изображения/видео/аудио.
ВходПромпт, кадры или референсы изображения/видео/аудио
Лучше всего дляБыстрая предвизуализация рекламы из промптов или кадров сториборда
Видео
Seedance 1.5 Pro
Видеомодель Seedance для генерации по тексту и изображению с синхронизацией звука и видео. Она поддерживает разрешение от 480p до 1080p, клипы длительностью 4–12 секунд, шесть соотношений сторон, динамичную или фиксированную камеру, необязательную генерацию аудио и синхронизацию губ.