Rivya 音频上传与录音要求
了解如何在 Rivya 支持的视频和参考生成流程中使用录音,核对音频格式、时长及配套素材,并确认录音清理目前暂停的边界。
最近审阅于 2026年9月9日
先确定想得到什么结果,再上传录音。音频可以是视频模型的输入,不一定要从音频 Studio 开始。页面有文件选择框、模型介绍提到某种能力,都不代表当前操作可运行。先查看模型可用状态。
按录音用途选择入口
| 你需要的结果 | 从哪里开始 | 录音在其中的作用 |
|---|---|---|
| 让人像根据录音说话 | Kling AI Avatar Standard、Kling AI Avatar Pro 或 OmniHuman 1.5 | 一张图片和一份音频生成视频,不是导出清理后的音频 |
| 让已有视频的口型匹配指定音频 | Volcengine Video Lip Sync | 一份视频与一份音频作为输入,得到新的视频结果 |
| 用声音引导视频生成 | Seedance 2.0 或 Seedance 2.0 Fast 的参考模式 | 录音为视频请求提供参考,不承诺修复或逐项复现原录音 |
| 从脚本生成新语音、对白、音乐或声音 | 音频 Studio和音频工作流 | 从文字和所选模型的设置开始,这些用途不需要上传旧录音 |
| 给现有录音降噪或分离语音 | 查看当前的音频清理说明 | ElevenLabs Audio Isolation 已暂停,文档中保留的输入说明不是可用的清理服务 |
文本转语音、对白和 Suno Sounds 会生成新音频,不能修复上传的录音。当前聊天附件选择器接受受支持的图片,不接受音频文件;不要把录音传到聊天中,期待自动转写或试听分析。上述入口也不代表网站提供通用的声音克隆服务。
按模型核对文件要求
完整输入规则以所选表单和参考文件要求为准。下面是具体实例,不是所有音频上传的通用限制。
| 模型或模式 | 音频要求 | 配套输入与其他限制 |
|---|---|---|
| Seedance 2.0 / 2.0 Fast 参考模式 | MP3 或 WAV,每份不超过 15 MB;每份时长 2–15 秒 | 最多 3 份音频参考,音频总时长不超过 15 秒;图片和视频另有各自要求 |
| Kling AI Avatar Standard / Pro | MP3、M4A、WAV、AAC 或 OGG;Rivya 当前上传上限为 95 MB;时长大于 0 且不超过 300 秒 | 恰好一张不超过 10 MB 的 JPEG 或 PNG 图片,加一份音频 |
| OmniHuman 1.5 | MP3、M4A、WAV、AAC 或 OGG,不超过 10 MB;时长大于 0 且严格小于 60 秒 | 恰好一张不超过 10 MB 的 JPEG、PNG 或 WebP 图片,加一份音频 |
| Volcengine Video Lip Sync | MP3、M4A、WAV、AAC 或 OGG,不超过 10 MB,且能读取到大于 0 的时长 | 恰好一份受支持的视频加一份音频;视频属性和 Lite/Basic 设置另有要求 |
例如,两份各 8 秒的音频都满足 Seedance 2.0 的单文件时长要求,但合计 16 秒,超过 15 秒总上限。先选取更短且相关的片段,重新导出后再上传。不要未经核对就把这个限制套用到其他 Seedance 版本或其他模型。
导出后在本地打开副本检查。改文件扩展名不等于格式转换,本地能播放也不代表满足模型的大小或时长限制。播放或上传确认有问题时,查看浏览器与文件排查。使用 OmniHuman 时,还要单独查看模型页面的提示词语言与长度要求;这与录音使用什么语言是两件事。
准备适合发送的副本
把原文件留在自己的设备上。另存一份副本,裁掉无关对话和私人内容,确认需要的语句开头、结尾都完整,再听一遍有没有截断、失真或意外静音。缩短片段时,仍应保留当前任务需要的完整表达。
确认你有权按预期用途使用录音、说话人的声音,以及配套图片或视频。上传前按安全上传指南准备。上传阶段文件就会离开浏览器,不需要等到生成;移除表单附件也不等于其他系统已经删除文件。只发送这次请求真正需要的内容。
上传并发送一次请求
登录后打开所选模型和操作。如果需要登录或切换页面,先把未发送文字、模型设置和源文件保存在本地,参见登录与草稿保护。
选择准备好的音频,以及必需的图片或视频。Seedance 2.0 参考模式使用音频参考区域。等待上传完成,再检查显示的文件、用途、数量,以及界面显示的时长。
提交前核对模式、相关设置和预计积分,再发送一次。上传完成不会自动开始生成。切换模型或模式可能重置设置、移除不兼容参考,所以发送前需要重新检查。
如果响应或网络状态不明确,在历史记录中查看原任务,不要立即重复提交。任务进行中看队列与等待说明,已记录失败则看失败任务与积分返还。
准备或上传文件不保证请求获受理、生成成功或达到某种质量。再次发起生成可能产生另一笔积分费用。
按实际用途检查结果
数字人或口型同步视频需要边听边完整观看:检查有没有漏字、口型是否对齐、面部是否出现异常变化、是否混入不需要的内容,以及语音起止是否完整。用音频引导的视频则要检查节奏或声音方向是否符合预期,不要默认每个录音细节都会保留。
替换或分享前先和原件对照。按结果下载说明保存可用结果,原文件另外保留。结果链接过期或预览无法播放,都不能直接证明生成失败或应返还积分;先检查实际文件。
针对拒绝原因处理,不要原样重试
看不到音频输入框,可能是所选操作不接受录音。购买套餐或换一份文件,都不能让暂停中的清理模型恢复可用。只有其他可用操作的结果确实符合需求时,才改用那个入口。
文件被拒绝时,阅读报错,核对真实格式、大小、时长、配套文件,以及模式的数量或总时长上限。在单独副本中修正相关问题,本地检查后再上传。如果已经提交过任务,先查看任务记录,再决定是否发起替代请求。
仍需帮助时,通过联系页面提供模型、模式、文件格式、大小、时长、可见错误、大致时间,以及存在时的任务编号。上传阶段出错可能还没有任务编号。首次联系不要附上密码、API 密钥、私有访问链接或敏感录音本身。
