Seedance 2.0
字节跳动完整版 Seedance 2.0 视频模型,当前在 Rivya 里完整接入了文生视频、首帧/首尾帧驱动,以及多模态参考生视频三类场景。产品层保留了与文档一致的角色拆分,避免把首尾帧和参考图/参考视频/参考音频混成一个模糊上传桶。
为什么考虑它
当下一个任务需要提示词、首尾帧,或图片/视频/音频参考时,可以考虑它。
从文字、1 至 2 张引导帧,或包含最多 9 张图片、3 段视频和 3 个音频文件的已验证多模态参考组合,制作 480p 或 720p Seedance 视频草稿。
示例输出
Seedance 2.0 Mini
文生视频 · 图生视频
示例输出
Seedance 2.0 Mini
适合任务
支持能力
在线试用
生成结果
从文字、1 至 2 张引导帧,或包含最多 9 张图片、3 段视频和 3 个音频文件的已验证多模态参考组合,制作 480p 或 720p Seedance 视频草稿。
暂时还没有结果,提交提示词后即可开始一次生成。
决策确认
决策确认
适合任务
任务接近这些情况时使用
安静事实
提供商
ByteDance
类别
视频
能力标签
文生视频 · 图生视频 · 参考图生视频
积分模式
per_input_and_output_second · 480p_with_video=2.4 · 480p_without_video=3.8 · 720p_with_video=5 · 720p_without_video=8.2 · ⌈total⌉
输入方式
最多 15 个参考素材
提示设置
最多 20,000 字
Seedance 2.0 Mini 常见问题
Seedance 2.0 Mini 有独立的 480p 与 720p 费率、4 至 15 秒输出范围和更小的参考素材上限。它适合紧凑的多模态草稿;Seedance 2.5 则增加 1080p、更长输出和更大的参考素材容量。
文字场景使用 3 至 20,000 个字符的提示词,不上传素材。帧场景采用相同的提示词范围,并上传恰好 1 张起始图片,或上传 2 张图片作为首尾帧,不能使用视频或音频。参考场景要求至少上传 1 个素材,可组合最多 9 张图片、3 段视频和 3 个音频文件。
图片支持 JPEG/PNG/WebP/GIF,每张不超过 30 MB。参考视频必须是 MP4/MOV/MKV,每段不超过 50 MB,时长为 2 至 15 秒,视频总时长不得超过 15 秒。MP3 或 WAV 音频每个不超过 15 MB,时长为 2 至 15 秒,音频总时长不得超过 15 秒。
图片和参考视频的宽、高都必须在 300 至 6,000 像素之间,画幅比例必须在 0.4 至 2.5 之间。参考视频的总像素数还必须在 409,600 至 927,408 之间,帧率为每秒 24 至 60 帧。
没有参考视频时,480p 按每输出秒 3.8 积分计费,720p 按每输出秒 8.2 积分计费。有视频输入时,480p 费率为 2.4,720p 费率为 5,并乘以已验证的输入视频秒数与请求输出秒数之和。小数费率会完整保留,Rivya 只对最终合计向上取整一次。
网页搜索仅接受文字场景。帧场景或参考场景启用网页搜索会被拒绝,因此添加引导素材前需要将其关闭。
Rivya 会在生成前按完整公式预留积分。若返回的实际用量有效且不高于预留值,就按实际用量结算。若实际用量缺失、无效或高于预留值,则保留在对账流程中,不会暗中追加扣费。
选择纯文字、帧引导或多模态参考场景,撰写至少 3 个字符的提示词,再设置 480p 或 720p、画幅比例,以及 4 至 15 秒之间的整数时长。
不可以。帧场景接受 1 至 2 张图片,并拒绝视频或音频。如果需要让图片、视频或音频共同引导同一段短片,请改用参考场景。
Rivya 当前上限是合计 15 个文件:最多 9 张图片、3 段视频和 3 个音频文件。视频与音频还各有 15 秒的独立总时长上限。
会。有视频输入的请求使用较低的有视频费率,但该费率会乘以已验证的输入视频秒数与请求输出秒数之和。只有图片和音频时仍采用无视频公式。
制作最长 15 秒的 480p 或 720p 草稿并使用较小参考组合时,可以继续选择 Mini。任务需要 1080p、最长 30 秒、自动时长、MOV 输出或更大的多模态组合时,可以考虑 Seedance 2.5。
比较替代模型
字节跳动完整版 Seedance 2.0 视频模型,当前在 Rivya 里完整接入了文生视频、首帧/首尾帧驱动,以及多模态参考生视频三类场景。产品层保留了与文档一致的角色拆分,避免把首尾帧和参考图/参考视频/参考音频混成一个模糊上传桶。
为什么考虑它
当下一个任务需要提示词、首尾帧,或图片/视频/音频参考时,可以考虑它。
字节跳动更快的 Seedance 2.0 视频模型,当前在 Rivya 里完整接入了文生视频、首帧/首尾帧驱动,以及多模态参考生视频三类场景。为了避免首尾帧和参考图/参考视频/参考音频的角色混淆,产品层保持了与文档一致的显式场景拆分。
为什么考虑它
当下一个任务需要提示词、首尾帧,或图片/视频/音频参考时,可以考虑它。
支持文生视频、图生视频和原生音视频同步的 Seedance 视频模型,提供 480p–1080p、4–12 秒片段、6 种宽高比、动态或固定镜头控制,以及唇形同步。
为什么考虑它
当下一个任务需要提示词 + 可选图片时,可以考虑它。