W
AI-Wiki
CONCEPT

Seedance 2.0 图片参考

定义

Seedance 2.0 图片参考Seedance 2.0 多模态参考控制 在图像素材上的具体用法:先上传一张或多张图片,再在提示词中以“图片1”“图片2”直到“图片n”准确指代参考对象,并说明要提取、保持或组合的元素。 模型会提取被指代图片中的核心特征,并与文字描述共同约束视频生成;因此,提示词不仅要说明“参考哪张图片”,还应说明参考其中的主体、服装、场景、构图或标识,以及这些元素在生成画面中的用途。

在提示词指南中的语境

该方法属于 Seedance 2.0 提示词指南 摘要 所述的多模态参考能力。相对于只用文本描述,图片参考用于锁定理想的主体形象、商品外观、画面构图或品牌元素,使生成结果兼具文本创作空间与更高的确定性、还原度。 图片参考可与 Seedance 2.0 提示词结构 中的主体、运动、环境、运镜、切镜和美学描述组合使用。例如,图片负责提供角色形象或商品质感,文本再规定角色动作、镜头推进、场景氛围与整体风格。

核心规则:顺序上传与编号指代

当多张图片的顺序会影响引用含义时,应先按预期顺序上传素材,再在提示词中使用对应编号,例如“参考图片1中的女孩”“图片1里的女孩身着图片2中的服装”“场景设定在图片4中的餐厅内”。 不要只笼统写“参考图片”或“参考这些图”。应明确图片编号、被参考元素和期望结果,例如“提取图1、图2、图3的相机”“保持图片2中杯身的细腻质感”“图片3中的男孩是一位顾客”。 常用句式为:参考、提取、结合、按照或生成 + “图片n”中的被参考元素 + 生成画面描述 + 保持该元素特征一致。

主体多视角参考

主体多视角参考用于将同一商品或角色的不同角度信息汇集到生成视频中,并保持其外观特征一致。 对于商品,可同时提取多张相机图片,将背景改为白色桌面,并要求镜头特写后围绕相机缓慢旋转,清晰展示正面、侧面和背面。也可以以一张图中的保温杯作为中景主体,再要求手部拿起并旋转杯身,重点展示另一张图中杯身的质感。 对于角色,可明确“参考图片1、图片2、图片3中的女子形象”,再生成该女子在咖啡店吃蛋糕等新场景。重点是指明要保持的是人物形象,而不是只描述新场景。

多图组合参考

多图组合参考允许把角色、服装、场景、Logo等元素拆分在不同图片中引用,并在同一视频内重新组合。 例如,可指定图片4作为餐厅场景、图片1作为女孩形象、图片2作为女孩服装、图片3作为男孩顾客,并让图片5中的标识始终显示在画面右下角。 多主体场景同样应分别指代主体来源,例如参考图片中的猫和狗,在温馨公寓中安排狗吃狗粮、猫靠近互动并依偎的连续动作。 这类提示的关键不是上传图片数量,而是清楚说明每张图提供什么元素、元素之间如何组合,以及哪些外观特征需要保持一致。

Logo 参考与显示时机

Logo 可作为被单独引用的图片元素,并由提示词控制其显示方式和时机。 若要求品牌标识在整个视频中保留,可明确写成“图片n中的标识始终显示在画面的右下角”。若要求片尾或特定转场后出现,可描述为画面逐渐模糊后出现某张图片中的 Logo。 Logo 的位置、是否持续显示、出现前后的镜头或转场条件,都应在提示词中写明;仅引用 Logo 图片不足以确定其时序和画面位置。

分镜图与多宫格分镜图参考

分镜图可用于约束单个镜头或连续镜头的构图与内容。可指定“参考图片1中的分镜图”,并要求其中各个分镜构图按顺序出现,再继续生成后续动作,例如人物激烈打斗。 多宫格分镜图尤其适合规定镜头顺序和镜头衔接:先按图片3的分镜构图呈现女孩等待父亲做饭的画面,再向右横摇切换到图片4的画面和构图,之后切回女孩的面部特写,再切换为父亲的面部特写。 使用分镜参考时,应同时写明每一步对应的构图来源、角色形象来源、镜头运动或切镜方式,以及后续画面内容;这样分镜图不只是视觉风格参考,也成为镜头顺序的约束。

细节与边界

图片编号以实际上传顺序为准;若上传顺序错误,提示词中的“图片1”“图片2”等指代就会对应错误素材。 图片参考用于提取和迁移被明确指定的核心特征,并与文本共同生成新视频,不等同于要求原图逐帧复现。要提高还原度,应具体说明需要保持的主体、外观、质感、构图、位置或显示时机。 涉及多元素、多镜头任务时,应避免让一张图片承担未说明的全部信息;应分别标注角色、服装、场景、Logo和分镜来源,并补充动作、运镜、切镜及风格要求。

相关条目