
快速美妆变身视频预览,展示成年美妆创作者、无品牌化妆台、刷具近景、顺滑过渡和最终完成妆。
视频简报:成年美妆创作者 / 无品牌化妆台 / 刷具近景 / 顺滑前后过渡 / 精致完成妆
Kling AI Avatar Standard 是 Rivya 里的低成本 AI 数字人口播模型,适合把 1 张人物图和 1 段音频生成带口型同步的主持人视频。

示例输出
快速美妆变身短片预览,重点呈现可读美妆动作、身份连续、无品牌产品和精致社交视频收尾。
数字人口播 · 图片+音频驱动

示例输出
快速美妆变身短片预览,重点呈现可读美妆动作、身份连续、无品牌产品和精致社交视频收尾。
适合任务
支持能力
在线试用
生成结果
Kling AI Avatar Standard 是 Rivya 里的低成本 AI 数字人口播模型,适合把 1 张人物图和 1 段音频生成带口型同步的主持人视频。
暂时还没有结果,提交提示词后即可开始一次生成。
提示词起步
当你不想从空白输入开始时,可以先用已经映射到 Kling AI Avatar Standard 的模板,再按自己的任务改写。
模型示例
先用上方在线试用区开始生成,再结合这些示例结果判断成品质感、输出节奏和任务适配度,然后决定是否继续在完整工作台里投入更多积分。
主示例
快速美妆变身视频预览,展示成年美妆创作者、无品牌化妆台、刷具近景、顺滑过渡和最终完成妆。
输入
1 张图片 + 1 段音频
看点提示
快速美妆变身视频预览,展示成年美妆创作者、无品牌化妆台、刷具近景、顺滑过渡和最终完成妆。
每次消耗积分
8 积分 / 次
为什么它适合
固定图片 + 音频驱动的数字人口播流程
当前固定 8 积分
口型同步路径清晰
最适合的任务
模型示例
决策确认
决策确认
适合任务
任务接近这些情况时使用
安静事实
提供商
Kuaishou
类别
视频
能力标签
数字人口播 · 图片+音频驱动
积分模式
8 积分 / 次
输入方式
1 张图片 + 1 段音频
提示设置
可选
Kling AI Avatar Standard 常见问题
如果这条视频本身就适合用 1 张人物图加 1 段音频完成,Kling AI Avatar Standard 会更合适。它更适合简单数字人口播、内部说明、低风险的主持人口播短片这类任务,重点不是追求最精致的高级感,而是用固定价格先把一版可用结果稳定跑出来。
在 Rivya 里,这个选项的范围很明确:1 张人物图、1 段音频,再加一条可选提示词。当前固定为 8 积分 / 次,因此它更像简单直接的数字人口播入口,而不是按时长计费的长流程说话视频选项。
最关键的通常不是参数,而是素材本身。只要人物图正脸清楚、嘴部没有遮挡、人物形象就是你想保留的那个版本,音频也已经是可以直接拿来用的那一条,Standard 往往就够了。如果这条内容更偏品牌发布或你对成片质感更挑剔,那就更值得往 Pro 走。
当前为固定 8 积分 / 次。它适合短解释视频、内部口播和早期客户演示,尤其适合先稳定拿到一条可用数字人口播,再决定是否升级到 Pro。
如果你需要的是最简单、易理解的固定价人物图加音频口播流程,Kling AI Avatar Standard 会更合适。同样是数字人形式,如果你更在意成片质感和品牌感,更适合使用 Kling AI Avatar Pro;如果希望价格随音频时长变化,或者任务本身更像时长驱动的说话视频,Infinitalk 这类选项会更合适。
如果这次只是想先确认 1 张人物图加 1 段音频能否生成可用的数字人口播,这页就够用。它很适合内部说明、简单口播和低成本数字人试稿等任务,可以先判断第一版方向,再进入更完整的制作流程。
这页就是围绕 1 张人物图、1 段音频和一个可选提示词来跑的。它没有更重的公开控制项,所以初步测试的重点不是怎么调很多参数,而是看你手上的人物图和音频,够不够支撑一条简单的 lip sync 口播视频。
先确认人物图是正脸、五官清楚、嘴部没有被挡住,音频也确实是你想保留的那条版本。这个模型本来就走轻量选项,所以素材质量往往比额外调参更重要。
这页可以先公开访问,但真正提交数字人生成前仍需要先登录。当前为固定 8 积分 / 次,你可以先把人物图、音频和大致语气准备好,再登录执行。
如果你现在只是想验证这组人物图和音频能否生成一条可用的 Standard 口播视频,继续留在这页就够了。等项目开始需要保留版本、更换多套人物素材、反复修订,或者围绕同一位出镜人物连续产出时,再切到完整创作工作台会更顺。
比较替代模型
字节跳动完整版 Seedance 2.0 视频模型,当前在 Rivya 里完整接入了文生视频、首帧/首尾帧驱动,以及多模态参考生视频三类场景。产品层保留了与文档一致的角色拆分,避免把首尾帧和参考图/参考视频/参考音频混成一个模糊上传桶。
为什么考虑它
当下一个任务需要提示词、首尾帧,或图片/视频/音频参考时,可以考虑它。
字节跳动更快的 Seedance 2.0 视频模型,当前在 Rivya 里完整接入了文生视频、首帧/首尾帧驱动,以及多模态参考生视频三类场景。为了避免首尾帧和参考图/参考视频/参考音频的角色混淆,产品层保持了与文档一致的显式场景拆分。
为什么考虑它
当下一个任务需要提示词、首尾帧,或图片/视频/音频参考时,可以考虑它。
支持文生视频、图生视频和原生音视频同步的 Seedance 视频模型,提供 480p–1080p、4–12 秒片段、6 种宽高比、动态或固定镜头控制,以及唇形同步。
为什么考虑它
当下一个任务需要提示词 + 可选图片时,可以考虑它。