Doubao Seedance 2.5
定义与身份
Doubao Seedance 2.5(下称 Seedance 2.5)是面向视频创作的多模态生成模型。它将长叙事、强参考、准编辑和多语言生成结合,用于生成、编辑或延长视频内容。
角色与能力
Seedance 2.5 可支持单段最长 30 秒的视频直出;单次最多可输入 50 个图像、音频或视频参考素材。参考素材可对应同一主体,也可分别对应人物、动物、道具、场所、音色、动作或场景等不同对象。 模型支持文本、图片、视频和音频的灵活组合输入,并提供较强的指令控制、专业级可控的视频编辑与延长能力。其原生支持生成 10 余种语言,适用于全球化叙事场景。 来源将其画面表现概括为真实感增强,并指出其在光影、表演理解与执行、镜头运动方面更接近真实拍摄,以提升成片质感与叙事可信度。
输入与输出锁定规则
Seedance 2.5 按输入素材是否锁定输出视频属性区分任务;这一分类在 Seedance 2.0 中没有。
- 有锁定:输入素材会严格成为输出视频时间轴中的一段,模型需要适应该素材,因此会锁定输出视频的宽高比,甚至时长。
- 无锁定:输入素材仅用于语义参考,用户仍可指定输出视频的宽高比和时长。 视频编辑、首尾帧和延长任务会根据输入素材自动锁定部分生成参数,不支持用户自行定义这些被锁定的参数;参考类任务的输出宽高比和时长通常不受输入素材锁定。
提示词与参考素材方法
官方建议以导演思维编写结构化 Prompt:先说明素材编号与用途,再用一句话概述主体、地点、事件、题材或风格与特殊运镜;随后按时间轴或“镜头 N”描述画面、运镜、动作、台词和音效;最后补充贯穿全片的机位、环境、声音与氛围。 当素材较多时,应按上传顺序明确“图 1/视频 1/音频 1”等编号及映射关系,并逐一列出多主体对应关系。例如,需明确哪些图片对应人物、哪些音频对应其音色,以及视频素材分别参考动作或运镜。仅在图片中写人物名称、而不在 Prompt 中说明映射,可能造成多人混淆或角色重复。 参考要求应具体到素材的哪一部分。若素材本身已足够准确,可仅声明严格参考某视频的动作与运镜,并减少对画面的重复复述。
编辑、首尾帧与时间控制
编辑任务应明确修改范围、修改内容和从 A 到 B 的变化过程;可借助时间戳指定局部修改,并说明其余内容保持不变。
首尾帧可将图片参数角色设为 first_frame 或 last_frame,此方式会锁定输出视频宽高比,并严格对齐输入视频的首帧图。也可将图片设为 reference_image,再在 Prompt 中指定首帧和尾帧;这种方式不锁定输出宽高比,但生成结果只会与参考图相近,不保证完全匹配。
时间戳以 1 秒为单位有助于组织剧情:某一时段内容过少时,模型可能自行发挥;内容过多时,可能出现过度剪切或剧情遗漏。因此应合理安排时长,不建议用时间戳控制高频次数,例如“一秒摇头 3 次”。
使用建议与边界
官方强烈建议使用 Seedance 2.5 skill 调优提示词,并可在 AI 对话框使用 /sd25-pe 加提示词内容进行调试。
模型的参考能力不等同于所有属性均可自由控制:编辑、首尾帧和延长会受到输入素材的参数锁定;参考图作为 reference_image 时也不能保证与首尾帧完全一致。