Bruk OmniHuman 1.5 når en person, et kjæledyr eller en illustrert figur skal opptre fra et ferdig stemmespor, mens kildeportrettet forblir det visuelle ankeret. Personidentifisering, motivdeteksjon og maskebasert valg er ikke tilgjengelig på denne siden.
Nøyaktig ett portrettbilde og ett lydspor holder arbeidsflyten fokusertFungerer med personer, kjæledyr og illustrerte motiver eller motiver i anime-stil
Sjekk inndata, utdata, kreditter og eksempelresultat, og prøv deretter modellen direkte på siden. Gå inn i Studio når du trenger lagret historikk, ressurser eller lengre iterasjoner.
Eksempelutdata
OmniHuman 1.5
Best egnet for
Presentatørvideoer drevet av et ferdig stemmesporKorte karakteropptredener fra ett godkjent portrettTalende klipp med kjæledyr eller illustrerte figurerFortellerstyrte videoer for sosiale medier og forklaringsvideoer
Støtter
Bilde + lyd til video
Test på nett
Prøv OmniHuman 1.5
Last opp ett portrett og ett lydklipp på under 60 sekunder, og velg deretter oppløsning, behandlingsmodus og valgfri seed.
Resultater
OmniHuman 1.5
ByteDanceAI.generator.modes.image-audio-to-video
Bruk OmniHuman 1.5 når en person, et kjæledyr eller en illustrert figur skal opptre fra et ferdig stemmespor, mens kildeportrettet forblir det visuelle ankeret. Personidentifisering, motivdeteksjon og maskebasert valg er ikke tilgjengelig på denne siden.
OmniHuman 1.5
Ingen resultater ennå. Send inn en prompt for å starte en kjøring.
Bilde + lyd til video
Beslutningsgrunnlag
Når denne modellen er riktig valg
Beslutningsgrunnlag
Egnethetssignaler
Nøyaktig ett portrettbilde og ett lydspor holder arbeidsflyten fokusert
Fungerer med personer, kjæledyr og illustrerte motiver eller motiver i anime-stil
Valgbare utdata i 720p og 1080p
Valgfri raskere behandlingsmodus
Kredittene følger den verifiserte lydlengden
Best egnede oppgaver
Bruk den når oppgaven ser slik ut
Presentatørvideoer drevet av et ferdig stemmesporKorte karakteropptredener fra ett godkjent portrettTalende klipp med kjæledyr eller illustrerte figurerFortellerstyrte videoer for sosiale medier og forklaringsvideoer
Fakta i korte trekk
Inndata, utdata og kreditter å bekrefte
Leverandør
ByteDance
Kategori
Video
Egenskaper
Bilde + lyd til video
Kredittoppsett
per_input_second · default=27 · ⌈total⌉
Inndataflyt
1 bilde + 1 lyd
Promptoppsett
Opptil 300 tegn
FAQ
OmniHuman 1.5 FAQ
Hva egner OmniHuman 1.5 seg best til?
OmniHuman 1.5 er laget for en fokusert bilde- og lydflyt: ett portrett gir motivet, og ett stemmespor styrer fremføringen. Den passer bedre til presentatørklipp, figurfortelling og korte videoer med talende motiver enn til en generell tekst-til-video-oppgave. Den styrer munnbevegelsen, men garanterer ikke absolutt leppesynkronisering.
Hvilke portrett- og lydfiler kan jeg laste opp?
Last opp nøyaktig ett JPEG-, PNG- eller WebP-bilde på opptil 10 MB og én MP3-, M4A-, WAV-, AAC- eller OGG-lydfil på opptil 10 MB. Den verifiserte lydlengden må være større enn null og strengt kortere enn 60 sekunder.
Hvordan beregnes kreditter for OmniHuman 1.5?
Rivya bruker en sats på 27 kreditter per verifisert lydsekund. Desimallengden beholdes i hele beregningen, og bare reservasjonssummen rundes opp til en hel kreditt. Når gyldig faktisk bruk rapporteres og ikke er høyere enn reservasjonen, avregner Rivya til dette beløpet; manglende, ugyldig eller høyere bruk enn reservasjonen sendes til avstemming uten at det utløser et skjult tilleggstrekk.
Hva endrer hurtigmodus?
Hurtigmodus prioriterer kortere behandlingstid med et mulig kvalitetstap. La den være av for en kvalitetsprioritert kjøring, og slå den på når leveringstid er viktigere i en tidlig test.
Kan jeg legge til en ledetekst for portrettet og lyden?
Ja, men den er valgfri og begrenset til 300 tegn på Rivya. Den gjeldende tekstflyten godtar skriftlig kinesisk, engelsk, japansk, koreansk, spansk eller indonesisk; portrett og lyd er fortsatt obligatoriske inndata.
Hva kan jeg lage på denne OmniHuman 1.5-siden?
Lag en lyddrevet figurvideo fra nøyaktig ett portrettbilde og ett lydklipp. Motivet kan være en person, et kjæledyr eller en illustrert figur, og utdata kan være 720p eller 1080p.
Hva bør jeg klargjøre før generering?
Velg et tydelig portrett som allerede representerer motivet du vil beholde, og klargjør deretter den endelige stemmeinnspillingen. Lyden må være kortere enn 60 sekunder, og begge filene må bestå opplastingskontrollene før generering.
Hvilke innstillinger er viktigst?
Velg 720p eller 1080p, bestem om du vil bruke raskere behandling, og la seed stå på -1 for et tilfeldig resultat med mindre du trenger en mer repeterbar sammenligning.
Må jeg logge inn, og hvordan fungerer kreditter?
Detaljene er offentlige, men opplasting og generering krever innlogging. OmniHuman 1.5 koster 27 kreditter per verifisert lydsekund, og bare den endelige beregnede summen rundes opp.
Når bør jeg åpne hele Studio?
Bli her for å teste ett portrett og ett stemmespor. Åpne Studio når du trenger lagrede opptak, flere figurer, gjentatte stemmeversjoner eller en lengre produksjonsflyt.
Sammenlign alternativer
Andre modeller å vurdere videre
Video
Seedance 2.0
ByteDances komplette Seedance 2.0-videomodell med egne genereringsmåter for video bare fra en prompt, rammestyrt animasjon og multimodal referansegenerering. Rivya viser rollefordelingen tydelig, slik at rammeinndata og multimodale referanser ikke blandes i ett uklart opplastingsfelt.
Hvorfor vurdere den
Vurder den når neste oppgave trenger Prompt, bilderammer eller bilde-/video-/lydreferanser.
InndataPrompt, bilderammer eller bilde-/video-/lydreferanser
ByteDances raskere Seedance 2.0-videomodell med egne genereringsmåter for video bare fra en prompt, rammestyrt bildeanimasjon og multimodal referansevideo. Rivya viser disse måtene tydelig, slik at inndata for første og siste ramme ikke blandes med rollene til referansebilder, video og lyd.
Hvorfor vurdere den
Vurder den når neste oppgave trenger Prompt, bilderammer eller bilde-/video-/lydreferanser.
InndataPrompt, bilderammer eller bilde-/video-/lydreferanser
Best egnet forRaske annonseforhåndsvisninger fra prompter eller storyboard-rammer
Video
Seedance 1.5 Pro
En Seedance-videomodell for tekst-til-video og bilde-til-video med innebygd synkronisering av lyd og bilde. Den støtter 480p–1080p, klipp på 4–12 sekunder, 6 sideforhold, dynamisk eller fast kamerakontroll, valgfri lydgenerering og leppesynkronisering.
Hvorfor vurdere den
Vurder den når neste oppgave trenger Prompt + valgfrie bilder.