Seedance 2.0
字节跳动完整版 Seedance 2.0 视频模型,当前在 Rivya 里完整接入了文生视频、首帧/首尾帧驱动,以及多模态参考生视频三类场景。产品层保留了与文档一致的角色拆分,避免把首尾帧和参考图/参考视频/参考音频混成一个模糊上传桶。
为什么考虑它
当下一个任务需要提示词、首尾帧,或图片/视频/音频参考时,可以考虑它。
根据文字、1 至 2 张引导帧或已验证的多模态素材组合,制作 4 至 15 秒的 MiniMax H3 视频,并使用专属 2K 档及明确的参考素材计费方式。
示例输出
MiniMax H3
文生视频 · 图生视频
示例输出
MiniMax H3
适合任务
支持能力
在线试用
生成结果
根据文字、1 至 2 张引导帧或已验证的多模态素材组合,制作 4 至 15 秒的 MiniMax H3 视频,并使用专属 2K 档及明确的参考素材计费方式。
暂时还没有结果,提交提示词后即可开始一次生成。
决策确认
决策确认
适合任务
任务接近这些情况时使用
安静事实
提供商
MiniMax
类别
视频
能力标签
文生视频 · 图生视频 · 参考图生视频
积分模式
per_input_and_output_second · 768P=16 · 2K=26 · additional_image_after_five=8 · ⌈total⌉
输入方式
最多 15 个参考素材
提示设置
最多 7,000 字
MiniMax H3 常见问题
MiniMax H3 适合制作 4 至 15 秒的视频,可以只用提示词构图,也可以使用 1 至 2 张引导帧或多模态参考素材组合。它的突出控制项是 768P 与 2K 两档,以及对输入视频时长和超过 5 张图片部分的明确计费。
三种场景都使用非空提示词,最多 7,000 个字符。文字场景不接受上传,并要求选择一个具体的非自适应画幅比例。帧场景接受恰好 1 张图片作为首帧或尾帧,或按顺序使用 2 张图片作为首尾帧,不接受视频或音频。参考场景要求至少上传 1 个素材;音频不能单独使用,必须搭配图片或视频。
Rivya 接受最多 9 张 JPEG、PNG 或 WebP 图片、3 段 MP4 或 MOV 视频,以及 3 个 MP3 或 WAV 音频文件,全部素材合计不得超过 15 个文件。每张图片不超过 30 MB。每段视频不超过 50 MB、时长为 2 至 15 秒,视频总时长不超过 15 秒;每个音频不超过 15 MB、时长为 2 至 15 秒,音频总时长不超过 15 秒。
图片和参考视频的宽、高都必须在 256 至 5,760 像素之间,画幅比例必须在 0.4 至 2.5 之间。参考视频的帧率还必须在每秒 23.976 至 60 帧之间。
768P 费率为 16 积分,2K 费率为 26 积分,乘以请求输出秒数与已验证输入视频秒数之和。前 5 张图片不增加图片费用,第 6 至第 9 张图片每张增加 8 积分。输入音频不计入此公式。Rivya 只对最终合计向上取整一次。
文生视频必须选择 21:9、16:9、4:3、1:1、3:4 或 9:16,不接受自适应。参考生成视频还可以使用自适应。帧引导路径从所提供的图片或图片对取得画幅,不发送单独的画幅比例值。
Rivya 会在生成前按公式预留积分,保留全部费率项,只对完整合计向上取整。若返回的实际用量有效且不高于预留值,就按实际用量结算。若实际用量缺失、无效或高于预留值,则保留在对账流程中,不会暗中追加扣费。
选择文字、帧引导或多模态参考场景;设置 768P 或 2K;选择 4 至 15 秒之间的整数时长;并且只在所选场景接受时使用画幅比例。
不可以。在参考场景中,音频必须搭配至少 1 张图片或 1 段视频。文字场景和帧场景不接受音频。
可以。只有 1 张图片时,可选择将它作为首帧或尾帧;使用 2 张图片时,按首帧、尾帧的顺序排列。
前 5 张图片已包含在基础时间公式中。第 6 至第 9 张图片每张会在合计估算中增加 8 积分,然后再对最终合计向上取整一次。
测试动作与参考素材作用时,可以先使用每计费秒 16 积分的 768P。场景方向已经确定并准备进入更高档位时,再选择每计费秒 26 积分的 2K。
可以先在本页验证一种场景、时长和参考素材层级。需要保存 768P 与 2K 对比、反复修改参考素材,或开展更长的项目流程时,再进入 Studio。
比较替代模型
字节跳动完整版 Seedance 2.0 视频模型,当前在 Rivya 里完整接入了文生视频、首帧/首尾帧驱动,以及多模态参考生视频三类场景。产品层保留了与文档一致的角色拆分,避免把首尾帧和参考图/参考视频/参考音频混成一个模糊上传桶。
为什么考虑它
当下一个任务需要提示词、首尾帧,或图片/视频/音频参考时,可以考虑它。
字节跳动更快的 Seedance 2.0 视频模型,当前在 Rivya 里完整接入了文生视频、首帧/首尾帧驱动,以及多模态参考生视频三类场景。为了避免首尾帧和参考图/参考视频/参考音频的角色混淆,产品层保持了与文档一致的显式场景拆分。
为什么考虑它
当下一个任务需要提示词、首尾帧,或图片/视频/音频参考时,可以考虑它。
支持文生视频、图生视频和原生音视频同步的 Seedance 视频模型,提供 480p–1080p、4–12 秒片段、6 种宽高比、动态或固定镜头控制,以及唇形同步。
为什么考虑它
当下一个任务需要提示词 + 可选图片时,可以考虑它。
开发者接入
MiniMax H3 已有可调用的 Public API 模式,但参考素材模式仍需要 Files API 上传支持。提交前请先查看模型参考。