Rivya AI-dokumentation

Ladda upp ljud i Rivya – format, längd och modellval

Använd inspelningar med Rivyas videomodeller. Kontrollera filformat, längd och övriga indata, och se varför ljudrensning fortfarande är pausad.

Senast granskad 2026/09/09

Utgå från vilket resultat du behöver innan du laddar upp en inspelning. Ljud kan vara indata till en videomodell, så Audio Studio är inte alltid rätt startpunkt. Att en sida beskriver en uppladdning eller visar ett filfält betyder inte att modellen går att köra just nu. Kontrollera först modellens tillgänglighet.

Välj hur inspelningen ska användas

Önskat resultatBörja härVad filen används till
Ett porträtt som talar enligt inspelningenKling AI Avatar Standard, Kling AI Avatar Pro eller OmniHuman 1.5En bild och en ljudfil blir en video, inte en rensad ljudfil
Anpassa en befintlig video till ett ljudspårVolcengine Video Lip SyncEn video och en ljudfil används för att skapa en ny video
Låta ljud vägleda en videogenereringSeedance 2.0 eller Seedance 2.0 Fast i referenslägetInspelningen vägleder videon; modellen lovar inte att reparera eller återge källan exakt
Skapa nytt tal, dialog, musik eller ljud från textAudio Studio och ljudarbetsflödenUtgå från text och modellens inställningar; en gammal inspelning behövs inte för dessa användningar
Ta bort brus eller isolera tal ur en inspelningLäs om ljudrensningElevenLabs Audio Isolation är pausad; dokumenterade indata innebär inte att ljudrensningen är tillgänglig

Text-till-tal, dialog och Suno Sounds skapar nytt ljud. De reparerar inte en uppladdad inspelning. Chattens nuvarande bilageväljare tar emot bilder som stöds, inte ljud. Ladda därför inte upp en inspelning där för transkribering eller bedömning genom avlyssning. De här funktionerna är inte heller en allmän tjänst för röstkloning.

Kontrollera filen mot den valda modellen

Se det valda formuläret och kraven på referensfiler för samtliga villkor. Exemplen nedan är modellspecifika, inte gemensamma gränser för alla ljudfiler.

Modell eller lägeLjudkravAndra filer och begränsningar
Seedance 2.0 / 2.0 Fast, referenslägeMP3 eller WAV, högst 15 MB per fil, 2–15 sekunder per filHögst 3 ljudreferenser med en sammanlagd längd på högst 15 sekunder; bilder och videor har egna krav
Kling AI Avatar Standard / ProMP3, M4A, WAV, AAC eller OGG; Rivyas aktuella uppladdningsgräns är 95 MB; längden ska vara över 0 och högst 300 sekunderExakt en JPEG- eller PNG-bild på högst 10 MB och en ljudfil
OmniHuman 1.5MP3, M4A, WAV, AAC eller OGG, högst 10 MB; längden ska vara över 0 och strikt under 60 sekunderExakt en JPEG-, PNG- eller WebP-bild på högst 10 MB och en ljudfil
Volcengine Video Lip SyncMP3, M4A, WAV, AAC eller OGG, högst 10 MB, med en läsbar längd över 0Exakt en video som stöds och en ljudfil; videons egenskaper och inställningarna Lite/Basic har separata krav

Två ljudreferenser på 8 sekunder vardera överskrider till exempel Seedance 2.0:s totalgräns på 15 sekunder, trots att båda klarar den individuella gränsen. Välj kortare, relevanta avsnitt och exportera dem på nytt. Använd inte samma gränser för en annan Seedance-version eller modell utan att kontrollera dess formulär.

Öppna den exporterade kopian lokalt. Att byta filändelse konverterar inte formatet, och lokal uppspelning bevisar inte att filen uppfyller modellens krav på storlek eller längd. Se felsökning av webbläsare och filer om uppspelningen eller bekräftelsen av uppladdningen inte fungerar. För OmniHuman behöver du också kontrollera vilka språk och vilken längd som tillåts för instruktionen på modellsidan; det är skilt från språket i inspelningen.

Förbered en kopia som går att dela

Behåll originalet på din enhet. Ta bort ovidkommande samtal och privat innehåll i en separat kopia. Kontrollera att början och slutet av det tal som behövs finns kvar, och lyssna efter avklippta ord, distorsion och oavsiktliga tysta partier. Även ett kortare utdrag behöver innehålla hela det avsnitt som uppgiften kräver.

Kontrollera att du får använda inspelningen, rösten och tillhörande bild eller video för det avsedda resultatet. Följ råden för säker uppladdning innan du skickar filen. Filen lämnar webbläsaren redan vid uppladdningen, före generering. Att ta bort en bilaga i formuläret bekräftar inte att den raderats i andra system. Skicka bara det material som behövs.

Ladda upp och skicka en begäran

  1. Logga in och öppna vald modell och funktion. Spara oskickad text, inställningar och originalfiler lokalt inför inloggning eller sidbyte; se inloggning och skydd av utkast.

  2. Välj den förberedda ljudfilen och den bild eller video som krävs. Använd området för ljudreferenser i Seedance 2.0:s referensläge. Vänta tills uppladdningen är klar och kontrollera sedan filerna som visas, deras roller, antal och längder där de anges.

  3. Kontrollera läget, relevanta inställningar och uppskattad kreditkostnad innan du skickar en gång. En färdig uppladdning startar inte genereringen. Byte av modell eller läge kan återställa inställningar eller ta bort referenser som inte stöds; kontrollera allt igen före sändning.

  4. Om svaret eller anslutningen är oklart, kontrollera den befintliga uppgiften i historiken innan du skickar igen. Följ kö- och väntetidsguiden för pågående uppgifter och guiden om misslyckade uppgifter och återförda krediter för registrerade fel.

Att förbereda eller ladda upp filen garanterar varken att begäran godkänns, att genereringen lyckas eller en viss kvalitet. En andra genereringsbegäran kan medföra en egen kreditkostnad.

Bedöm resultatet utifrån det faktiska målet

Titta och lyssna igenom hela videon när du använder avatarer eller läppsynkronisering. Kontrollera saknade ord, munrörelsernas timing, synliga ansiktsförändringar, oönskat innehåll och talets början och slut. För video med ljudreferens bedömer du om rytmen eller ljudkaraktären blev den avsedda; räkna inte med att varje detalj i inspelningen bevaras.

Jämför resultatet med originalet innan du ersätter eller delar något. Spara användbara resultat enligt nedladdningsguiden och behåll originalet separat. En utgången länk eller en förhandsvisning som inte går att spela upp bevisar inte att genereringen misslyckades eller att krediter ska återföras. Kontrollera först själva filen.

Åtgärda orsaken till avvisningen innan du försöker igen

Om ljudfältet saknas kan den valda funktionen sakna stöd för inspelningar. Att köpa en plan eller välja en annan fil gör inte en pausad ljudrensningsmodell tillgänglig. Välj bara en annan tillgänglig funktion om dess resultat faktiskt löser din uppgift.

Om filen avvisas, läs meddelandet och kontrollera verkligt format, storlek, längd, tillhörande filer samt lägets gränser för antal och sammanlagd längd. Åtgärda det aktuella problemet i en separat kopia och kontrollera den lokalt före nästa uppladdning. Om en uppgift redan har skickats, kontrollera dess post innan du startar en ersättare.

Behöver du mer hjälp, använd kontaktformuläret. Ange modell, läge, filformat, storlek, längd, synligt fel, ungefärlig tid och uppgifts-ID om det finns. Uppladdningsfel kan inträffa innan något ID skapas. Skicka inte lösenord, API-nycklar, privata länkar eller den känsliga inspelningen i det första meddelandet.