↓
Rivya AI 文档

Rivya 音频上传与录音要求

了解如何在 Rivya 支持的视频和参考生成流程中使用录音,核对音频格式、时长及配套素材,并确认录音清理目前暂停的边界。

最近审阅于 2026年9月9日

先确定想得到什么结果,再上传录音。音频可以是视频模型的输入,不一定要从音频 Studio 开始。页面有文件选择框、模型介绍提到某种能力,都不代表当前操作可运行。先查看模型可用状态。

按录音用途选择入口

你需要的结果从哪里开始录音在其中的作用
让人像根据录音说话Kling AI Avatar Standard、Kling AI Avatar Pro 或 OmniHuman 1.5一张图片和一份音频生成视频,不是导出清理后的音频
让已有视频的口型匹配指定音频Volcengine Video Lip Sync一份视频与一份音频作为输入,得到新的视频结果
用声音引导视频生成Seedance 2.0 或 Seedance 2.0 Fast 的参考模式录音为视频请求提供参考,不承诺修复或逐项复现原录音
从脚本生成新语音、对白、音乐或声音音频 Studio和音频工作流从文字和所选模型的设置开始,这些用途不需要上传旧录音
给现有录音降噪或分离语音查看当前的音频清理说明ElevenLabs Audio Isolation 已暂停,文档中保留的输入说明不是可用的清理服务

文本转语音、对白和 Suno Sounds 会生成新音频,不能修复上传的录音。当前聊天附件选择器接受受支持的图片,不接受音频文件;不要把录音传到聊天中,期待自动转写或试听分析。上述入口也不代表网站提供通用的声音克隆服务。

按模型核对文件要求

完整输入规则以所选表单和参考文件要求为准。下面是具体实例,不是所有音频上传的通用限制。

模型或模式音频要求配套输入与其他限制
Seedance 2.0 / 2.0 Fast 参考模式MP3 或 WAV,每份不超过 15 MB;每份时长 2–15 秒最多 3 份音频参考,音频总时长不超过 15 秒;图片和视频另有各自要求
Kling AI Avatar Standard / ProMP3、M4A、WAV、AAC 或 OGG;Rivya 当前上传上限为 95 MB;时长大于 0 且不超过 300 秒恰好一张不超过 10 MB 的 JPEG 或 PNG 图片,加一份音频
OmniHuman 1.5MP3、M4A、WAV、AAC 或 OGG,不超过 10 MB;时长大于 0 且严格小于 60 秒恰好一张不超过 10 MB 的 JPEG、PNG 或 WebP 图片,加一份音频
Volcengine Video Lip SyncMP3、M4A、WAV、AAC 或 OGG,不超过 10 MB,且能读取到大于 0 的时长恰好一份受支持的视频加一份音频;视频属性和 Lite/Basic 设置另有要求

例如,两份各 8 秒的音频都满足 Seedance 2.0 的单文件时长要求,但合计 16 秒,超过 15 秒总上限。先选取更短且相关的片段,重新导出后再上传。不要未经核对就把这个限制套用到其他 Seedance 版本或其他模型。

导出后在本地打开副本检查。改文件扩展名不等于格式转换,本地能播放也不代表满足模型的大小或时长限制。播放或上传确认有问题时,查看浏览器与文件排查。使用 OmniHuman 时,还要单独查看模型页面的提示词语言与长度要求;这与录音使用什么语言是两件事。

准备适合发送的副本

把原文件留在自己的设备上。另存一份副本,裁掉无关对话和私人内容,确认需要的语句开头、结尾都完整,再听一遍有没有截断、失真或意外静音。缩短片段时,仍应保留当前任务需要的完整表达。

确认你有权按预期用途使用录音、说话人的声音,以及配套图片或视频。上传前按安全上传指南准备。上传阶段文件就会离开浏览器,不需要等到生成;移除表单附件也不等于其他系统已经删除文件。只发送这次请求真正需要的内容。

上传并发送一次请求

  1. 登录后打开所选模型和操作。如果需要登录或切换页面,先把未发送文字、模型设置和源文件保存在本地,参见登录与草稿保护。

  2. 选择准备好的音频,以及必需的图片或视频。Seedance 2.0 参考模式使用音频参考区域。等待上传完成,再检查显示的文件、用途、数量,以及界面显示的时长。

  3. 提交前核对模式、相关设置和预计积分,再发送一次。上传完成不会自动开始生成。切换模型或模式可能重置设置、移除不兼容参考,所以发送前需要重新检查。

  4. 如果响应或网络状态不明确,在历史记录中查看原任务,不要立即重复提交。任务进行中看队列与等待说明,已记录失败则看失败任务与积分返还。

准备或上传文件不保证请求获受理、生成成功或达到某种质量。再次发起生成可能产生另一笔积分费用。

按实际用途检查结果

数字人或口型同步视频需要边听边完整观看:检查有没有漏字、口型是否对齐、面部是否出现异常变化、是否混入不需要的内容,以及语音起止是否完整。用音频引导的视频则要检查节奏或声音方向是否符合预期,不要默认每个录音细节都会保留。

替换或分享前先和原件对照。按结果下载说明保存可用结果,原文件另外保留。结果链接过期或预览无法播放,都不能直接证明生成失败或应返还积分;先检查实际文件。

针对拒绝原因处理,不要原样重试

看不到音频输入框,可能是所选操作不接受录音。购买套餐或换一份文件,都不能让暂停中的清理模型恢复可用。只有其他可用操作的结果确实符合需求时,才改用那个入口。

文件被拒绝时,阅读报错,核对真实格式、大小、时长、配套文件,以及模式的数量或总时长上限。在单独副本中修正相关问题,本地检查后再上传。如果已经提交过任务,先查看任务记录,再决定是否发起替代请求。

仍需帮助时,通过联系页面提供模型、模式、文件格式、大小、时长、可见错误、大致时间,以及存在时的任务编号。上传阶段出错可能还没有任务编号。首次联系不要附上密码、API 密钥、私有访问链接或敏感录音本身。