Ladda upp ljud i Rivya – format, längd och modellval
Använd inspelningar med Rivyas videomodeller. Kontrollera filformat, längd och övriga indata, och se varför ljudrensning fortfarande är pausad.
Senast granskad 2026/09/09
Utgå från vilket resultat du behöver innan du laddar upp en inspelning. Ljud kan vara indata till en videomodell, så Audio Studio är inte alltid rätt startpunkt. Att en sida beskriver en uppladdning eller visar ett filfält betyder inte att modellen går att köra just nu. Kontrollera först modellens tillgänglighet.
Välj hur inspelningen ska användas
| Önskat resultat | Börja här | Vad filen används till |
|---|---|---|
| Ett porträtt som talar enligt inspelningen | Kling AI Avatar Standard, Kling AI Avatar Pro eller OmniHuman 1.5 | En bild och en ljudfil blir en video, inte en rensad ljudfil |
| Anpassa en befintlig video till ett ljudspår | Volcengine Video Lip Sync | En video och en ljudfil används för att skapa en ny video |
| Låta ljud vägleda en videogenerering | Seedance 2.0 eller Seedance 2.0 Fast i referensläget | Inspelningen vägleder videon; modellen lovar inte att reparera eller återge källan exakt |
| Skapa nytt tal, dialog, musik eller ljud från text | Audio Studio och ljudarbetsflöden | Utgå från text och modellens inställningar; en gammal inspelning behövs inte för dessa användningar |
| Ta bort brus eller isolera tal ur en inspelning | Läs om ljudrensning | ElevenLabs Audio Isolation är pausad; dokumenterade indata innebär inte att ljudrensningen är tillgänglig |
Text-till-tal, dialog och Suno Sounds skapar nytt ljud. De reparerar inte en uppladdad inspelning. Chattens nuvarande bilageväljare tar emot bilder som stöds, inte ljud. Ladda därför inte upp en inspelning där för transkribering eller bedömning genom avlyssning. De här funktionerna är inte heller en allmän tjänst för röstkloning.
Kontrollera filen mot den valda modellen
Se det valda formuläret och kraven på referensfiler för samtliga villkor. Exemplen nedan är modellspecifika, inte gemensamma gränser för alla ljudfiler.
| Modell eller läge | Ljudkrav | Andra filer och begränsningar |
|---|---|---|
| Seedance 2.0 / 2.0 Fast, referensläge | MP3 eller WAV, högst 15 MB per fil, 2–15 sekunder per fil | Högst 3 ljudreferenser med en sammanlagd längd på högst 15 sekunder; bilder och videor har egna krav |
| Kling AI Avatar Standard / Pro | MP3, M4A, WAV, AAC eller OGG; Rivyas aktuella uppladdningsgräns är 95 MB; längden ska vara över 0 och högst 300 sekunder | Exakt en JPEG- eller PNG-bild på högst 10 MB och en ljudfil |
| OmniHuman 1.5 | MP3, M4A, WAV, AAC eller OGG, högst 10 MB; längden ska vara över 0 och strikt under 60 sekunder | Exakt en JPEG-, PNG- eller WebP-bild på högst 10 MB och en ljudfil |
| Volcengine Video Lip Sync | MP3, M4A, WAV, AAC eller OGG, högst 10 MB, med en läsbar längd över 0 | Exakt en video som stöds och en ljudfil; videons egenskaper och inställningarna Lite/Basic har separata krav |
Två ljudreferenser på 8 sekunder vardera överskrider till exempel Seedance 2.0:s totalgräns på 15 sekunder, trots att båda klarar den individuella gränsen. Välj kortare, relevanta avsnitt och exportera dem på nytt. Använd inte samma gränser för en annan Seedance-version eller modell utan att kontrollera dess formulär.
Öppna den exporterade kopian lokalt. Att byta filändelse konverterar inte formatet, och lokal uppspelning bevisar inte att filen uppfyller modellens krav på storlek eller längd. Se felsökning av webbläsare och filer om uppspelningen eller bekräftelsen av uppladdningen inte fungerar. För OmniHuman behöver du också kontrollera vilka språk och vilken längd som tillåts för instruktionen på modellsidan; det är skilt från språket i inspelningen.
Förbered en kopia som går att dela
Behåll originalet på din enhet. Ta bort ovidkommande samtal och privat innehåll i en separat kopia. Kontrollera att början och slutet av det tal som behövs finns kvar, och lyssna efter avklippta ord, distorsion och oavsiktliga tysta partier. Även ett kortare utdrag behöver innehålla hela det avsnitt som uppgiften kräver.
Kontrollera att du får använda inspelningen, rösten och tillhörande bild eller video för det avsedda resultatet. Följ råden för säker uppladdning innan du skickar filen. Filen lämnar webbläsaren redan vid uppladdningen, före generering. Att ta bort en bilaga i formuläret bekräftar inte att den raderats i andra system. Skicka bara det material som behövs.
Ladda upp och skicka en begäran
Logga in och öppna vald modell och funktion. Spara oskickad text, inställningar och originalfiler lokalt inför inloggning eller sidbyte; se inloggning och skydd av utkast.
Välj den förberedda ljudfilen och den bild eller video som krävs. Använd området för ljudreferenser i Seedance 2.0:s referensläge. Vänta tills uppladdningen är klar och kontrollera sedan filerna som visas, deras roller, antal och längder där de anges.
Kontrollera läget, relevanta inställningar och uppskattad kreditkostnad innan du skickar en gång. En färdig uppladdning startar inte genereringen. Byte av modell eller läge kan återställa inställningar eller ta bort referenser som inte stöds; kontrollera allt igen före sändning.
Om svaret eller anslutningen är oklart, kontrollera den befintliga uppgiften i historiken innan du skickar igen. Följ kö- och väntetidsguiden för pågående uppgifter och guiden om misslyckade uppgifter och återförda krediter för registrerade fel.
Att förbereda eller ladda upp filen garanterar varken att begäran godkänns, att genereringen lyckas eller en viss kvalitet. En andra genereringsbegäran kan medföra en egen kreditkostnad.
Bedöm resultatet utifrån det faktiska målet
Titta och lyssna igenom hela videon när du använder avatarer eller läppsynkronisering. Kontrollera saknade ord, munrörelsernas timing, synliga ansiktsförändringar, oönskat innehåll och talets början och slut. För video med ljudreferens bedömer du om rytmen eller ljudkaraktären blev den avsedda; räkna inte med att varje detalj i inspelningen bevaras.
Jämför resultatet med originalet innan du ersätter eller delar något. Spara användbara resultat enligt nedladdningsguiden och behåll originalet separat. En utgången länk eller en förhandsvisning som inte går att spela upp bevisar inte att genereringen misslyckades eller att krediter ska återföras. Kontrollera först själva filen.
Åtgärda orsaken till avvisningen innan du försöker igen
Om ljudfältet saknas kan den valda funktionen sakna stöd för inspelningar. Att köpa en plan eller välja en annan fil gör inte en pausad ljudrensningsmodell tillgänglig. Välj bara en annan tillgänglig funktion om dess resultat faktiskt löser din uppgift.
Om filen avvisas, läs meddelandet och kontrollera verkligt format, storlek, längd, tillhörande filer samt lägets gränser för antal och sammanlagd längd. Åtgärda det aktuella problemet i en separat kopia och kontrollera den lokalt före nästa uppladdning. Om en uppgift redan har skickats, kontrollera dess post innan du startar en ersättare.
Behöver du mer hjälp, använd kontaktformuläret. Ange modell, läge, filformat, storlek, längd, synligt fel, ungefärlig tid och uppgifts-ID om det finns. Uppladdningsfel kan inträffa innan något ID skapas. Skicka inte lösenord, API-nycklar, privata länkar eller den känsliga inspelningen i det första meddelandet.
Videoreferenser i Rivya: bilder, bildrutor och rörelse
Välj rätt videoreferenser i Rivya: bilder, start- och slutbild, rörelsevideo eller ljud. Kontrollera uppladdningen och att produktens detaljer stämmer.
Säker uppladdning i Rivya: integritet och filförberedelser
Förbered referenser för Rivya, ta bort onödiga privata uppgifter och kontrollera tillstånd och modellstöd. Läs vad uppladdning och borttagning i formuläret innebär.
