Use o OmniHuman 1.5 quando uma pessoa, um animal de estimação ou um personagem ilustrado precisar atuar a partir de uma faixa de voz finalizada, mantendo o retrato de origem como âncora visual. A identificação de pessoas, a detecção de sujeitos e a seleção por máscara não estão disponíveis nesta página.
Exatamente uma imagem de retrato e uma faixa de áudio mantêm o fluxo concentradoFunciona com pessoas, animais de estimação e personagens ilustrados ou em estilo anime
Saída selecionável em 720p e 1080p
Entrada
1 imagem + 1 áudio
Saída
Gerador de vídeos com IA
Créditos
per_input_second · default=27 · ⌈total⌉
Melhor para
Vídeos de apresentadores guiados por uma faixa de voz finalizada
Confira entrada, saída, créditos e resultado de exemplo, depois teste este modelo diretamente na página. Vá para o Studio quando precisar de histórico salvo, ativos ou iteração mais longa.
Saída de exemplo
OmniHuman 1.5
Melhor para
Vídeos de apresentadores guiados por uma faixa de voz finalizadaAtuações curtas de personagens a partir de um único retrato aprovadoClipes falados com animais de estimação ou personagens ilustradosVídeos para redes sociais e explicativos guiados por narração
Suporta
Imagem + áudio para vídeo
Teste online
Experimente o OmniHuman 1.5
Envie um retrato e um clipe de áudio com menos de 60 segundos e escolha a resolução de saída, o modo de processamento e a seed opcional.
Resultados
OmniHuman 1.5
ByteDanceAI.generator.modes.image-audio-to-video
Use o OmniHuman 1.5 quando uma pessoa, um animal de estimação ou um personagem ilustrado precisar atuar a partir de uma faixa de voz finalizada, mantendo o retrato de origem como âncora visual. A identificação de pessoas, a detecção de sujeitos e a seleção por máscara não estão disponíveis nesta página.
OmniHuman 1.5
Ainda não há resultados. Envie um prompt para iniciar uma execução.
Imagem + áudio para vídeo
Ajuste de decisão
Quando este modelo é a escolha certa
Ajuste de decisão
Sinais de ajuste
Exatamente uma imagem de retrato e uma faixa de áudio mantêm o fluxo concentrado
Funciona com pessoas, animais de estimação e personagens ilustrados ou em estilo anime
Saída selecionável em 720p e 1080p
Modo opcional de processamento mais rápido
Os créditos acompanham a duração verificada do áudio
Tarefas mais adequadas
Use quando a tarefa se parecer com isto
Vídeos de apresentadores guiados por uma faixa de voz finalizadaAtuações curtas de personagens a partir de um único retrato aprovadoClipes falados com animais de estimação ou personagens ilustradosVídeos para redes sociais e explicativos guiados por narração
Fatos discretos
Entradas, saída e créditos a confirmar
Provedor
ByteDance
Categoria
Vídeo
Capacidades
Imagem + áudio para vídeo
Modelo de créditos
per_input_second · default=27 · ⌈total⌉
Caminho de entrada
1 imagem + 1 áudio
Configuração de prompt
Até 300 caracteres
FAQ
FAQ de OmniHuman 1.5
Para que o OmniHuman 1.5 é mais indicado?
O OmniHuman 1.5 foi projetado para um fluxo focado em imagem e áudio: um retrato fornece o tema, e uma faixa de voz orienta a atuação resultante. Ele é mais adequado para clipes de apresentadores, narração de personagens e vídeos curtos com sujeitos falantes do que para uma tarefa geral de prompt para vídeo.
Quais arquivos de retrato e áudio posso enviar?
Envie exatamente uma imagem JPEG, PNG ou WebP de até 10 MB e um arquivo de áudio MP3, M4A, WAV, AAC ou OGG de até 10 MB. A duração verificada do áudio deve ser maior que zero e estritamente menor que 60 segundos.
Como os créditos do OmniHuman 1.5 são calculados?
A Rivya usa uma tarifa de 27 créditos por segundo de áudio verificado. A duração decimal permanece no cálculo completo, e apenas o total da reserva é arredondado para cima até um crédito inteiro. Quando é informado um uso real válido e não superior à reserva, a Rivya faz o acerto por esse valor; se o uso estiver ausente, for inválido ou superar o valor reservado, ele segue para conciliação, sem gerar cobrança adicional oculta.
O que o modo rápido altera?
O modo rápido prioriza um tempo de processamento menor, com uma possível perda de qualidade. Mantenha-o desativado em uma geração focada em qualidade e ative-o quando a agilidade for mais importante em um teste inicial.
Posso adicionar um prompt ao retrato e ao áudio?
Sim, mas ele é opcional e limitado a 300 caracteres na Rivya. O fluxo atual de prompt aceita texto em chinês, inglês, japonês, coreano, espanhol ou indonésio; o retrato e o áudio continuam sendo as entradas obrigatórias.
O que posso criar nesta página do OmniHuman 1.5?
Crie um vídeo de personagem guiado por áudio usando exatamente uma imagem de retrato e um clipe de áudio. O sujeito pode ser uma pessoa, um animal de estimação ou um personagem ilustrado, e a saída pode ser em 720p ou 1080p.
O que devo preparar antes de gerar?
Escolha um retrato nítido que já represente o sujeito que você quer manter e prepare a tomada de voz final. O áudio deve ter menos de 60 segundos, e os dois arquivos precisam passar pelas verificações de upload antes da geração.
Quais configurações são mais importantes?
Escolha 720p ou 1080p, decida se usará a opção de processamento mais rápido e mantenha a seed em -1 para obter um resultado aleatório, a menos que precise de uma comparação mais repetível.
Preciso entrar na conta e como funcionam os créditos?
Os detalhes são públicos, mas o upload e a geração exigem acesso à conta. O OmniHuman 1.5 custa 27 créditos por segundo de áudio verificado, com apenas o total final calculado arredondado para cima.
Quando devo abrir o Studio completo?
Continue aqui para testar um retrato e uma faixa de voz. Abra o Studio quando precisar de tomadas salvas, vários personagens, versões repetidas da voz ou um fluxo de produção mais longo.
Comparar alternativas
Outros modelos para considerar em seguida
Vídeo
Seedance 2.0
O modelo de vídeo Seedance 2.0 completo da ByteDance, com suporte explícito a geração apenas por prompt, animação guiada por quadros e geração com referência multimodal. A Rivya mantém explícita a divisão de papéis documentada para que entradas de quadros e referências multimodais permaneçam mutuamente exclusivas, em vez de virarem um único campo ambíguo de upload.
Por que considerar
Considere quando sua próxima tarefa precisar de Prompt, quadros ou referências de imagem/vídeo/áudio.
EntradaPrompt, quadros ou referências de imagem/vídeo/áudio
O modelo de vídeo Seedance 2.0 mais rápido da ByteDance, com roteamento completo de cenas para geração apenas por prompt, animação de imagem guiada por quadros e geração de vídeo com referência multimodal. A Rivya mantém explícita a divisão de cenas documentada para que entradas de primeiro/último quadro não entrem em conflito com papéis de imagem, vídeo e áudio de referência.
Por que considerar
Considere quando sua próxima tarefa precisar de Prompt, quadros ou referências de imagem/vídeo/áudio.
EntradaPrompt, quadros ou referências de imagem/vídeo/áudio
Melhor paraPré-visualização rápida de anúncios a partir de prompts ou quadros de storyboard
Vídeo
Seedance 1.5 Pro
Modelo de vídeo Seedance para texto para vídeo e imagem para vídeo, com sincronização nativa entre áudio e imagem. Oferece 480p a 1080p, clipes de 4 a 12s, 6 proporções, controle de lente dinâmica ou fixa, geração de áudio opcional e lip sync.
Por que considerar
Considere quando sua próxima tarefa precisar de Prompt + imagens opcionais.