Använd OmniHuman 1.5 när en person, ett husdjur eller en illustrerad karaktär ska framträda utifrån ett färdigt röstspår samtidigt som källporträttet förblir den visuella utgångspunkten. Personidentifiering, motividentifiering och maskbaserat val är inte tillgängliga på den här sidan.
Exakt en porträttbild och ett ljudspår håller arbetsflödet fokuseratFungerar med personer, husdjur och illustrerade motiv eller motiv i animestil
Valbar output i 720p och 1080p
Inmatning
1 bild + 1 ljudfil
Resultat
AI-videogenerator
Krediter
per_input_second · default=27 · ⌈total⌉
Bäst för
Presentatörsvideor som styrs av ett färdigt röstspår
Kontrollera inmatning, utdata, krediter och exempelresultat och prova sedan modellen direkt på sidan. Gå vidare till Studio när du behöver sparad historik, resurser eller längre iteration.
Exempelresultat
OmniHuman 1.5
Bäst för
Presentatörsvideor som styrs av ett färdigt röstspårKorta karaktärsframträdanden från ett godkänt porträttTalande klipp med husdjur eller illustrerade karaktärerBerättarröststyrda videor för sociala medier och förklaringsvideor
Stöder
Bild + ljud till video
Onlinetest
Testa OmniHuman 1.5
Ladda upp ett porträtt och ett ljudklipp på under 60 sekunder och välj sedan outputupplösning, bearbetningsläge och valfritt Seed-värde.
Resultat
OmniHuman 1.5
ByteDanceAI.generator.modes.image-audio-to-video
Använd OmniHuman 1.5 när en person, ett husdjur eller en illustrerad karaktär ska framträda utifrån ett färdigt röstspår samtidigt som källporträttet förblir den visuella utgångspunkten. Personidentifiering, motividentifiering och maskbaserat val är inte tillgängliga på den här sidan.
OmniHuman 1.5
Inget resultat ännu. Skicka en prompt för att starta en körning.
Bild + ljud till video
Beslutsstöd
När denna modell är rätt val
Beslutsstöd
Passningssignaler
Exakt en porträttbild och ett ljudspår håller arbetsflödet fokuserat
Fungerar med personer, husdjur och illustrerade motiv eller motiv i animestil
Valbar output i 720p och 1080p
Valfritt läge för snabbare bearbetning
Krediterna följer den verifierade ljudlängden
Uppgifter den passar bäst för
Använd den när uppgiften ser ut så här
Presentatörsvideor som styrs av ett färdigt röstspårKorta karaktärsframträdanden från ett godkänt porträttTalande klipp med husdjur eller illustrerade karaktärerBerättarröststyrda videor för sociala medier och förklaringsvideor
Sakliga fakta
Inmatning, resultat och krediter att bekräfta
Leverantör
ByteDance
Kategori
Video
Förmågor
Bild + ljud till video
Kreditmodell
per_input_second · default=27 · ⌈total⌉
Inmatningsväg
1 bild + 1 ljudfil
Promptkonfiguration
Upp till 300 tecken
FAQ
OmniHuman 1.5 FAQ
Vad passar OmniHuman 1.5 bäst för?
OmniHuman 1.5 fungerar bäst för presentatörsvideor som styrs av ett färdigt röstspår, korta karaktärsframträdanden från ett godkänt porträtt, talande klipp med husdjur eller illustrerade karaktärer, berättarröststyrda videor för sociala medier och förklaringsvideor, jämförelser av kvalitetsprioriterad och snabbare bearbetning med samma porträtt- och ljudpar.
Vilka porträtt- och ljudfiler kan jag ladda upp?
Ladda upp exakt en JPEG-, PNG- eller WebP-bild på högst 10 MB och en MP3-, M4A-, WAV-, AAC- eller OGG-ljudfil på högst 10 MB. Den verifierade ljudlängden måste vara större än noll och strikt kortare än 60 sekunder.
Hur beräknas krediter för OmniHuman 1.5?
Rivya använder en nivå på 27 krediter per verifierad ljudsekund. Decimallängden ingår i hela beräkningen och endast den sammanlagda reservationen avrundas uppåt till en hel kredit. När giltig faktisk användning som inte överstiger reservationen rapporteras reglerar Rivya kostnaden till den. Saknad, ogiltig eller högre användning än reservationen går i stället till avstämning och utlöser ingen dold tilläggsdebitering.
Vad ändrar snabbläget?
Snabbläget prioriterar kortare bearbetningstid med en möjlig kvalitetsavvägning. Lämna det avstängt för en kvalitetsprioriterad körning och slå på det när kortare svarstid är viktigare för ett tidigt test.
Kan jag lägga till en prompt till porträttet och ljudet?
Ja, men den är valfri och begränsad till 300 tecken på Rivya. Den nuvarande promptvägen accepterar text på kinesiska, engelska, japanska, koreanska, spanska eller indonesiska; porträttet och ljudet förblir obligatoriska indata. Absolut läppsynkronisering garanteras inte.
Vad kan jag skapa på den här sidan för OmniHuman 1.5?
Skapa en ljudstyrd karaktärsvideo från exakt en porträttbild och ett ljudklipp. Motivet kan vara en person, ett husdjur eller en illustrerad karaktär, och output kan vara 720p eller 1080p.
Vad bör jag förbereda före genereringen?
Välj ett tydligt porträtt som redan representerar motivet du vill behålla och förbered sedan den slutliga rösttagningen. Ljudet måste vara kortare än 60 sekunder och båda filerna måste klara uppladdningskontrollerna före genereringen.
Vilka inställningar är viktigast?
Välj 720p eller 1080p, avgör om det snabbare bearbetningsalternativet ska användas och lämna Seed på -1 för ett slumpmässigt resultat om du inte behöver en mer upprepningsbar jämförelse.
Måste jag logga in, och hur fungerar krediter?
Detaljerna är offentliga, men uppladdning och generering kräver inloggning. OmniHuman 1.5 kostar 27 krediter per verifierad ljudsekund och endast den slutliga beräknade summan avrundas uppåt.
När bör jag öppna hela Studio?
Stanna här för att testa ett porträtt och ett röstspår. Öppna Studio när du behöver sparade tagningar, flera karaktärer, upprepade röstversioner eller ett längre produktionsflöde.
Jämför alternativ
Andra modeller att överväga härnäst
Video
Seedance 2.0
ByteDances fullständiga videomodell Seedance 2.0 med uttryckligt stöd för generering med enbart prompt, bildrutedriven animering och multimodal referensgenerering. Rivya håller den dokumenterade rollindelningen tydlig så att bildruteindata och multimodala referenser förblir ömsesidigt uteslutande i stället för att kollapsa till en tvetydig uppladdningsgrupp.
Varför överväga den
Överväg den när din nästa uppgift behöver Prompt, bildrutor eller bild-/video-/ljudreferenser.
InmatningPrompt, bildrutor eller bild-/video-/ljudreferenser
ByteDances snabbare videomodell Seedance 2.0 med full scenroutning för generering med enbart prompt, bildrutedriven bildanimering och multimodal generering av referensvideo. Rivya håller den dokumenterade scenindelningen tydlig så att indata för första och sista bildruta inte kolliderar med rollerna för referensbild, video och ljud.
Varför överväga den
Överväg den när din nästa uppgift behöver Prompt, bildrutor eller bild-/video-/ljudreferenser.
InmatningPrompt, bildrutor eller bild-/video-/ljudreferenser
Bäst förSnabb reklamförvisualisering från prompter eller storyboardrutor
Video
Seedance 1.5 Pro
En Seedance-videomodell för text-till-video och bild-till-video med inbyggd audiovisuell synkronisering. Den stöder klipp på 4–12s i 480p–1080p, 6 bildförhållanden, dynamisk eller fast objektivkontroll, valfri ljudgenerering och läppsynk.
Varför överväga den
Överväg den när din nästa uppgift behöver Prompt + valfria bilder.