Brug OmniHuman 1.5, når en person, et kæledyr eller en illustreret karakter skal optræde ud fra et færdigt stemmespor, mens kildeportrættet forbliver det visuelle holdepunkt. Personidentifikation, motivregistrering og maskebaseret valg er ikke tilgængelige på denne side.
Præcis ét portrætbillede og ét lydspor holder arbejdsgangen fokuseretFungerer med mennesker, kæledyr og illustrerede motiver eller motiver i anime-stil
Valgbart output i 720p og 1080p
Input
1 billede + 1 lyd
Output
AI-videogenerator
Credits
per_input_second · default=27 · ⌈total⌉
Bedst til
Præsentationsvideoer styret af et færdigt stemmespor
Tjek input, output, credits og eksempelresultat, og prøv derefter denne model direkte på siden. Gå ind i Studio, når du har brug for gemt historik, aktiver eller længere iteration.
Eksempeloutput
OmniHuman 1.5
Bedst til
Præsentationsvideoer styret af et færdigt stemmesporKorte karakteroptrædener fra ét godkendt portrætTalende klip med kæledyr eller illustrerede karaktererFortællerdrevne videoer til sociale medier og forklaringsvideoer
Understøtter
Billede + lyd til video
Onlineprøve
Prøv OmniHuman 1.5
Upload ét portræt og ét lydklip på under 60 sekunder, og vælg derefter outputopløsning, behandlingstilstand og et valgfrit seed.
Resultater
OmniHuman 1.5
ByteDanceAI.generator.modes.image-audio-to-video
Brug OmniHuman 1.5, når en person, et kæledyr eller en illustreret karakter skal optræde ud fra et færdigt stemmespor, mens kildeportrættet forbliver det visuelle holdepunkt. Personidentifikation, motivregistrering og maskebaseret valg er ikke tilgængelige på denne side.
OmniHuman 1.5
Intet resultat endnu. Indsend en prompt for at starte en kørsel.
Billede + lyd til video
Beslutningstilpasning
Hvornår denne model er det rigtige valg
Beslutningstilpasning
Matchsignaler
Præcis ét portrætbillede og ét lydspor holder arbejdsgangen fokuseret
Fungerer med mennesker, kæledyr og illustrerede motiver eller motiver i anime-stil
Valgbart output i 720p og 1080p
Valgfri hurtigere behandlingstilstand
Kreditter følger den kontrollerede lydvarighed
Opgaver med bedst match
Brug den, når opgaven ser sådan ud
Præsentationsvideoer styret af et færdigt stemmesporKorte karakteroptrædener fra ét godkendt portrætTalende klip med kæledyr eller illustrerede karaktererFortællerdrevne videoer til sociale medier og forklaringsvideoer
Rolige fakta
Input, output og credits at bekræfte
Udbyder
ByteDance
Kategori
Video
Evner
Billede + lyd til video
Creditmodel
per_input_second · default=27 · ⌈total⌉
Inputvej
1 billede + 1 lyd
Promptopsætning
Op til 300 tegn
FAQ
OmniHuman 1.5 FAQ
Hvad egner OmniHuman 1.5 sig bedst til?
OmniHuman 1.5 er udviklet til en fokuseret billed- og lydarbejdsgang: Ét portræt leverer motivet, og ét stemmespor styrer den resulterende optræden. Den passer bedre til præsentationsklip, karakterfortælling og korte videoer med talende motiver end til en almindelig prompt-til-video-opgave.
Hvilke portræt- og lydfiler kan jeg uploade?
Upload præcis ét JPEG-, PNG- eller WebP-billede på højst 10 MB og én MP3-, M4A-, WAV-, AAC- eller OGG-lydfil på højst 10 MB. Den kontrollerede lydvarighed skal være større end nul og strengt under 60 sekunder.
Hvordan beregnes kreditter for OmniHuman 1.5?
Rivya bruger en sats på 27 kreditter pr. kontrolleret lydsekund. Decimalvarigheden indgår i hele beregningen, og kun det samlede reservationsbeløb rundes op til en hel kredit. Når der rapporteres et gyldigt faktisk forbrug, som ikke er højere end reservationen, afregner Rivya efter det; manglende, ugyldigt eller højere forbrug end reserveret forbliver i afstemning i stedet for at udløse en skjult ekstrabetaling.
Hvad ændrer hurtig tilstand?
Hurtig tilstand prioriterer kortere behandlingstid med et muligt kvalitetstab. Lad den være slået fra til en kvalitetsprioriteret kørsel, og slå den til, når gennemløbstiden er vigtigere i en tidlig test.
Kan jeg føje en prompt til portrættet og lyden?
Ja, men den er valgfri og begrænset til 300 tegn på Rivya. Den nuværende promptsti accepterer kun skriftlig tekst på kinesisk, engelsk, japansk, koreansk, spansk eller indonesisk; portrættet og lyden er fortsat obligatoriske input. Resultatet kan efterligne tale og mundbevægelser, men der gives ingen absolut garanti for perfekt læbesynkronisering.
Hvad kan jeg oprette på denne OmniHuman 1.5-side?
Opret en lydstyret karaktervideo ud fra præcis ét portrætbillede og ét lydklip. Motivet kan være en person, et kæledyr eller en illustreret karakter, og output kan være 720p eller 1080p.
Hvad skal jeg forberede før generering?
Vælg et tydeligt portræt, som allerede repræsenterer det motiv, du vil bevare, og forbered derefter den færdige stemmeoptagelse. Lyden skal være kortere end 60 sekunder, og begge filer skal bestå uploadkontrollerne før generering.
Hvilke indstillinger er vigtigst?
Vælg 720p eller 1080p, afgør om du vil bruge den hurtigere behandling, og behold seed på -1 for et tilfældigt resultat, medmindre du har brug for en mere gentagelig sammenligning.
Skal jeg logge ind, og hvordan fungerer kreditter?
Oplysningerne er offentlige, men upload og generering kræver login. OmniHuman 1.5 koster 27 kreditter pr. kontrolleret lydsekund, og kun det endelige beregnede beløb rundes op.
Hvornår bør jeg åbne hele Studio?
Bliv her for at afprøve ét portræt og ét stemmespor. Åbn Studio, når du har brug for gemte optagelser, flere karakterer, gentagne stemmeversioner eller en længere produktionsarbejdsgang.
Sammenlign alternativer
Andre modeller at overveje næst
Video
Seedance 2.0
ByteDances fulde Seedance 2.0-videomodel med tydelig understøttelse af prompt-only-generering, frame-styret animation og multimodal referencegenerering. Rivya holder den dokumenterede rolleopdeling tydelig, så frame-input og multimodale referencer forbliver gensidigt adskilte i stedet for at falde sammen i én uklar uploadspand.
Hvorfor overveje den
Overvej den, når din næste opgave kræver Prompt, frames eller billed-/video-/lydreferencer.
InputPrompt, frames eller billed-/video-/lydreferencer
ByteDances hurtigere Seedance 2.0-videomodel med fuld scene-routing til prompt-only-generering, frame-styret billedanimation og multimodal referencevideogenerering. Rivya holder den dokumenterede sceneopdeling tydelig, så første/sidste-frame-input ikke blandes sammen med rollerne for referencebilleder, video og lyd.
Hvorfor overveje den
Overvej den, når din næste opgave kræver Prompt, frames eller billed-/video-/lydreferencer.
InputPrompt, frames eller billed-/video-/lydreferencer
Bedst tilHurtig annonceprevis fra prompts eller storyboard-frames
Video
Seedance 1.5 Pro
En Seedance-videomodel til tekst-til-video og billede-til-video med indbygget audiovisuel synkronisering. Den understøtter 480p til 1080p, klip på 4 til 12 sekunder, seks billedformater, dynamisk eller fast kamerastyring, valgfri lydgenerering og læbesynkronisering.
Hvorfor overveje den
Overvej den, når din næste opgave kræver Prompt + valgfrie billeder.