Seedance 2.5
定义与身份
Seedance 2.5 是视频生成模型 Seedance 2.0 的增强版本,定位不止于生成单条效果出色的视频,而是强化可复用、可交付和可规模化生产所需的编辑、续写、参考控制与衔接能力。
它在画面宽高比、音画衔接、可控性和工作流适配方面进行系统性补强,因而更接近端到端工业化视频生产的使用阶段。
角色与适用任务
Seedance 2.5 可用于从文本、图片、视频及其组合中生成或处理视频,覆盖以下生产环节:
- 通过时间、镜头、动作、表情、运镜、转场和音频描述组织剧情。
- 以首帧、尾帧、关键帧、主体、场景、道具或白模视频约束画面与动态。
- 对已有视频执行编辑、续写、延长、音频语言替换或多段视频衔接。
- 将多张图片组织为成片,并生成相应的趣味音频或背景音乐。
相对 Seedance 2.0 的主要增强
- 整数秒时间戳:Seedance 2.0 不响应时间戳、只响应镜头序号;Seedance 2.5 可以响应以整数秒表示的时间安排。
- 多视图主体参考:Seedance 2.0 不建议用多视图作为主体参考;Seedance 2.5 支持这种参考方式。
- 自由宽高比:Seedance 2.0 的输出宽高比为固定 6 档;Seedance 2.5 可通过控制输入素材,在
0.4至2.5之间输出任意宽高比。 - MOV 输出:Seedance 2.5 支持 MOV 格式输出,用于延长或编辑任务时,可更好保持颜色与亮度一致性以及声画一致性。
- 生产能力补强:支持更长视频生成、更多素材参考,以及更稳定的编辑和续写能力。
时间与剧情控制
时间戳以“1 秒”为单位,可用于梳理故事发展。例如可连续写为 0-3 秒……3-7 秒……7-15 秒,或使用 [1s-4s]……[4s-8s]……[8s-12s]。也可表达具体时点或停顿,如“第 2 秒一道金雷自画面顶部直落”“主角按下快门后画面定格 1 秒”。
使用时应保持时间轴连续,避免出现“0-3 秒……5-6 秒……”这类缺段表达。指定时段内剧情过少时,模型会进行一定自由发挥;内容过多则可能造成过度剪切或剧情遗漏,因此应让事件量与时长相匹配。
时间戳不适合控制高频重复动作,例如“不建议写一秒摇头 3 次”。动作优先使用概括性描述,只对少数记忆点动作补充具体细节,避免反复描述同一动作;表情宜使用可观察的描述性语句,而非仅使用成语。
素材、画幅与关键帧控制
首帧与尾帧
优先可将图片参数 role 设置为 first_frame 或 last_frame。这种方式会锁定输出视频宽高比,并严格对齐输入首帧图。
也可将图片设置为 reference_image,再在提示词中指定哪张图片是首帧或尾帧,例如“图片 3 为首帧,图片 5 为尾帧”。此方式不锁定输出宽高比,生成视频会与参考图相近,但不会完全匹配。
多关键帧与分镜
需要严格按分镜生成时,应把分镜作为独立参考按顺序传入,并在提示词第一句明确“以图片 x 至图片 x 的顺序作为关键帧”。
宫格分镜更适合 15 个以下分镜;一次输入过多,例如 18 宫格,容易出现静止或顺序错乱。宫格图不会被严格逐帧对齐,并会限制模型发挥;若必须严格遵循分镜,应改用多关键帧参考。
建议使用简约的线稿或火柴人分镜,并在提示词中补全分镜没有表达的信息,可结合时间戳明确剧情逻辑。避免使用过度锐化、杂乱的分镜图,也不建议在图上叠加过多文字。
白模视频与参考叠加
Seedance 2.5 支持输入包含运动、运镜、动线和光照等动态或时序信息的白模视频进行渲染,并可叠加主体、场景、道具等参考图控制渲染效果。
当前版本对简单建模的参考效果较好,建议以简单几何体表示人物、物体或动物。白模视频中的主体宜只保留躯体,避免包含四肢、翅膀等精细运动元素;若已包含,则需补全动作序列,否则渲染结果可能出现四肢僵化。
白模仅需参考运镜和运动时,应在提示词中明确“参考视频 1 的运镜、动作”;若还需光影,应明确参考其光影变化。叠加参考图时,需要写清图片主体与白模主体的对应关系。即使输入白模视频,也应详细描述希望生成的内容,并保证文本描述与白模内容一致;没有额外参考的白模主体,补充外表与特征通常更有利于控制结果。
镜头、转场与音频
可直接使用常见景别、运镜和机位描述,包括大全景、全景、中景、近景、特写,推、拉、摇、移、跟、环绕、俯冲、后拉、上摇、手持晃动,以及低角度、俯视和第一人称。
一镜到底、希区柯克变焦、航拍视角、FPV、子弹时间、手持镜头和回弹变速等常见运镜也可直接描述。过于小众或专业的术语应写为“术语 + 描述性解释”,例如说明移焦时焦点如何从前景平滑转至背景。
转场应写明触发点、时间与方式,例如“第 5 秒快速向左横移转场(向左擦除 + 自然叠化)”。提示词还应避免前后矛盾,以及不合理的运镜或运动设计。
音频可进行负向控制,并可分别控制音效、背景音乐(BGM)与对白。延长任务中,生成视频音量相对输入视频可能略有变化;若输入视频本身由 Seedance 2.5 生成,音量变化通常较小,无缝衔接效果相对更好。
编辑、续写与衔接边界
模型可在原视频基础上续写指定时长,并通过 MOV 输出改善延长或编辑片段与原片在颜色、亮度及声画上的一致性。它也可按指令对视频人声台词进行中文翻译并调整口型,同时要求其余内容保持不变。
对于两段视频衔接,可描述飞行、折返、俯冲、物体形变等过渡动作,并要求自然无缝地连接两段素材;但提示词中应明确不要改变上传的原视频内容。
这些能力提高了可控性,但不意味着所有参考都会完全复现:使用 reference_image 的首尾帧仅保证相近,宫格分镜也存在模型自主发挥;时间过密、参考过多或提示词互相冲突均可能削弱结果稳定性。