Seedance 2.0
字节跳动完整版 Seedance 2.0 视频模型,当前在 Rivya 里完整接入了文生视频、首帧/首尾帧驱动,以及多模态参考生视频三类场景。产品层保留了与文档一致的角色拆分,避免把首尾帧和参考图/参考视频/参考音频混成一个模糊上传桶。
为什么考虑它
当下一个任务需要提示词、首尾帧,或图片/视频/音频参考时,可以考虑它。
使用文字、引导帧或已验证多模态参考生成 Wan 3.0 视频,再选择标准版或 Prime、分辨率、宽高比、时长、生成音频和随机种子。
示例输出
Wan 3.0 Video
文生视频 · 图生视频
示例输出
Wan 3.0 Video
适合任务
支持能力
在线试用
生成结果
使用文字、引导帧或已验证多模态参考生成 Wan 3.0 视频,再选择标准版或 Prime、分辨率、宽高比、时长、生成音频和随机种子。
暂时还没有结果,提交提示词后即可开始一次生成。
决策确认
决策确认
适合任务
任务接近这些情况时使用
安静事实
提供商
Alibaba
类别
视频
能力标签
文生视频 · 图生视频 · 参考图生视频 · 视频生视频
积分模式
per_input_and_output_second · standard_480P=8 · standard_720P=16 · standard_1080P=32 · prime_480P=12.2 · prime_720P=25.2 · prime_1080P=50.4 · ⌈total⌉
输入方式
最多 20 个参考素材
提示设置
最多 20,000 字
Wan 3.0 Video 常见问题
文字场景不接收上传素材。首尾帧场景必须提供一张首帧图片,并可选提供一张尾帧图片。参考场景接收由图片、视频和音频组成的已签名多模态素材包,但音频不能作为唯一素材。三个场景互斥。 文字模式必须填写提示词,首尾帧和参考模式可不填;去除首尾空格后最多 20,000 个字符。
Standard: 8 / 16 / 32; Prime: 12.2 / 25.2 / 50.4 每计费秒 (480P / 720P / 1080P). 预授权按版本与分辨率费率乘以“已验证输入视频秒数 + 预留输出秒数”,最后仅向上取整一次;智能时长预留 30 秒输出,不能与参考视频同时使用。
Standard: 8 / 16 / 32; Prime: 12.2 / 25.2 / 50.4 每计费秒 (480P / 720P / 1080P). 预授权按版本与分辨率费率乘以“已验证输入视频秒数 + 预留输出秒数”,最后仅向上取整一次;智能时长预留 30 秒输出,不能与参考视频同时使用。
参考场景最多接收 10 张图片、5 段 MP4 或 MOV 视频和 5 段 MP3 或 WAV 音频。每段视频或音频必须为 1–15 秒,视频和音频各自还有 15 秒的合计上限。不能只提交音频。
图片可以是 JPEG、无透明通道 PNG、WebP 或 BMP,单张不超过 20 MB,宽高均为 240–8,000 像素,宽高比不超过 8。视频必须是 MP4 或 MOV,单段不超过 95 MB,每边为 240–4,096 像素,并同样保持在 8:1 比例边界内。
-1 允许模型选择输出时长,因此 Rivya 会按 30 秒上限预留。智能时长不能与参考视频组合;存在视频输入时,应选择明确时长,使已验证输入加输出不超过 30 秒。有效实际用量不高于预留时会完成结算并退还差额;缺失、无效或更高的用量会保留原预留并进入对账,不会隐藏补扣。
选择文字、首尾帧或多模态参考;选择标准版或 Prime;设置 480P、720P 或 1080P;选择自适应或固定宽高比;使用 2–30 秒或智能时长,并控制生成音频和随机种子。
可以。首尾帧场景必须提供一张首帧图片,并接受一张可选尾帧图片。该场景拒绝视频和音频,以保持输入合同清晰。
不可以。音频可以配合图片或视频参考,但不能成为唯一上传素材。
会。参考视频要求明确的输出时长,而且已验证输入视频秒数加请求输出秒数不能超过 30。
Rivya 会在建任务和预留积分前,把用户、模型、URL、真实 MIME 类型、字节大小、几何信息和媒体时长绑定到已签名元数据。任意外部链接和文件快捷输入继续保持不可用。
先用本页验证一个场景、档位和参考层级。需要保存多轮版本、使用多组参考素材或比较标准版与 Prime 时,再继续到 Studio。
比较替代模型
字节跳动完整版 Seedance 2.0 视频模型,当前在 Rivya 里完整接入了文生视频、首帧/首尾帧驱动,以及多模态参考生视频三类场景。产品层保留了与文档一致的角色拆分,避免把首尾帧和参考图/参考视频/参考音频混成一个模糊上传桶。
为什么考虑它
当下一个任务需要提示词、首尾帧,或图片/视频/音频参考时,可以考虑它。
字节跳动更快的 Seedance 2.0 视频模型,当前在 Rivya 里完整接入了文生视频、首帧/首尾帧驱动,以及多模态参考生视频三类场景。为了避免首尾帧和参考图/参考视频/参考音频的角色混淆,产品层保持了与文档一致的显式场景拆分。
为什么考虑它
当下一个任务需要提示词、首尾帧,或图片/视频/音频参考时,可以考虑它。
支持文生视频、图生视频和原生音视频同步的 Seedance 视频模型,提供 480p–1080p、4–12 秒片段、6 种宽高比、动态或固定镜头控制,以及唇形同步。
为什么考虑它
当下一个任务需要提示词 + 可选图片时,可以考虑它。