
Seedance 2.5 多参考图/视频/音频指南
On this page
一张清晰的人像、一张精美的场景静止图,以及一段快速的相机剪辑,都可能将同一个视频引向不同的方向。问题很少在于某一个参考不够好,而在于这组参考之间缺乏层级关系。
我是 Mira。在组合参考之前,我想知道哪个文件决定角色面部,哪个决定场景设置,哪个被允许影响动作。本篇 **Seedance 2.5 多参考(multi reference)**指南将向您展示如何在生成视频之前构建这个清晰的角色分工图。
什么是 Seedance 2.5 中的多参考?
多参考生成是指将多个素材资产作为一个视频创意简报来使用。图片可以定义主体和场景,视频可以演示动作,而音频则可以引导配音或节奏。提示词则明确指出要从每个素材中借鉴什么。
字节跳动(ByteDance)表示,Seedance 2.5 每次生成最多支持 30 张图片、10 个视频片段和 10 个音频片段。其官方多参考示例将图片分别分配给演员、乐器、场地和观众区域。具体平台的使用权限可能会有所限制。

目前的 Loova AI 参考图生成视频工作区公开显示了多图上传功能,但并未包含 Seedance 2.5 的所有视频或音频选项。请以您登录后的实际控制面板作为操作边界。
为每项任务选择合适的参考
从能够涵盖外观、地点、动作和声音的最小素材集开始。如果两个文件控制同一个特征,请选择其中一个,或者解释它们之间的关系。
| 参考素材 | 赋予其这项任务 | 排除在其任务之外 |
|---|---|---|
@Image 1 |
角色面部、发型、服装 | 背景和姿势 |
@Image 2 |
产品形状、标签、颜色 | 光照和相机角度 |
@Image 3 |
地点和一天中的时间 | 角色身份 |
@Video 1 |
动作和相机节奏 | 主体外观 |
@Audio 1 |
声音或节奏 | 视觉风格 |
角色和产品参考
使用能够清晰看到关键细节的视角。如果多张图片展示同一个主体,请予以说明:@Images 1–3 展示了同一款瓶子的正面、侧面和背面。请仅生成一个瓶子。 仅命名必须保持一致的角色特征。
不要让一张图片同时控制身份、姿势、地点、光线和风格,除非所有这些元素都需要同时迁移。

地点和风格参考
地点参考可以确立布局、天气或光线;风格参考可以确立色调或纹理。如果一张图片同时具备这两者,请缩小其作用范围:@Image 4 仅定义咖啡馆吧台、窗户布局和温暖的晨光。
当您只需要其色彩氛围时,避免使用“复制此图片”这类宽泛的指令。
动作和相机参考
在支持的情况下,使用视频来控制动作节奏、相机轨迹、过渡或调度:@Video 1 仅定义缓慢的顺时针环绕和节奏;将其应用于 @Image 1 的产品。
如果视频的唯一任务是提供动作,那么视频画面中不需要包含相同的主体。将其裁剪到相关的动作片段即可。
配音和音频参考
在可用时,音频可以定义声音、环境音或时机。分配一个明确的目的:@Audio 1 仅定义说话者的声音。 对话语言需单独说明。
请使用您获得授权的音频。即使视觉角色是虚构的,使用辨识度高的声音也可能会引发授权和冒充方面的顾虑。
如何在 Loova AI 上创建多参考视频
公开页面列出了多图上传、提示词输入框以及其他设置。可用的控制选项可能取决于您的账户类型。
选择必要的素材资产

从一个主要主体开始,仅添加文字无法可靠描述的内容。一个产品场景可能需要产品、地点和第二个角度,而不是一个完整的灵感板。在上传之前,请确认客户工作、人脸或声音的许可,删除机密或敏感的个人数据,并仔细阅读当前的使用条款和隐私政策。
为每个参考分配角色
在编写场景方向之前,先写下角色分工图。例如:
@Image 1 定义了在每个镜头中相同角色的面部、发型和绿色夹克。@Image 2 仅定义书店书架和窗户光线。@Image 3 仅定义红色笔记本。角色走进书店,在桌子上找到了笔记本,并将其贴在夹克上。保持她的身份、服装和笔记本设计不变。
使用界面上的文件标签;保持每个文件与任务之间的一对一关联。
定义必须保持一致的内容
最后写一个简短的保留清单,仅涵盖那些一旦发生偏差就会导致结果无法使用的细节。
分工图明确后,在 Loova AI 参考图生成视频中构建您的第一个多图视频。提交最小的可行参考集,在添加另一个素材之前先评估一致性。
如何保持角色和产品的一致性

一致性在撰写提示词之前就已经开始。参考素材在发型、服装、包装、比例和颜色上应当保持一致。不同的标签或配饰会产生设计冲突,而不是提供额外的参考依据。
在相关联的镜头中使用相同的核心参考集,保持名称和文件角色稳定,并将变化描述为动作,而不是重新设计。对于产品,当精确的几何形状或文字至关重要时,避免进行变形。对于角色,说明谁拿着哪个物体以及每个人站在哪里,这样身份就不会是唯一稳定的特征。
如何解决冲突或被忽略的参考
首先诊断被忽略的任务,而不是被忽略的文件。如果地点错误,保持角色参考不变,并缩小地点指令。如果面部发生偏差,移除多余的风格图片,并强化角色角色。
使用以下修复顺序:
- 移除任何没有独特任务的参考。
- 解决文件之间的视觉矛盾。
- 将主要主体放在首位,并对其进行精确标记。
- 修改一项角色指令,然后使用相同的设置重新生成。
- 权重不足的参考可能只是在与更显著的指令竞争。增加重复并不总是解决办法,更清晰的优先级通常才是。
多参考的限制与权衡

模型的最大容量并不是推荐的使用目标。更多的素材会增加设置时间,并创造更多导致面部、色调、背景或动作线索冲突的机会。一个聚焦的素材集更容易调试和重复使用。
平台限制也可能与字节跳动的模型规范有所不同。Loova AI 目前公开的参考图生成视频页面列出的 JPG、PNG 和 WEBP 图片大小上限为每张 10MB,最小尺寸为 300×300px。该页面未公开列出视频/音频格式或其大小限制;在准备这些素材之前,请检查实时上传器的提示。
常见问题
Seedance 2.5 接受哪些文件格式和大小限制的参考素材?
在模型层面,字节跳动确认支持图片、视频和音频参考。在 Loova AI 当前的参考图生成视频页面上,公布的图片规则为 JPG、PNG 或 WEBP,每张大小不超过 10MB,最小尺寸为 300×300px。该公开页面上未说明视频和音频格式限制,因此请遵循实时上传器的验证消息。
我可以重复使用以前 Loova AI 项目中的参考文件吗?
公开的 Loova AI 参考工作区目前未记录跨项目素材重复使用的功能。请检查您登录后的项目或素材选择器是否显示了早前上传的内容。如果没有,请保留一个文件名稳定的本地参考包,并仅重新上传新场景所需的已批准文件。
为什么我上传的其中一个参考被忽略或权重不足?
它可能与另一个参考重复、与更强的指令冲突,或者缺乏指定的角色。移除没有独特任务的文件,准确说明要从被忽略的素材中提取什么,并将无关的背景或风格元素排除在其角色之外。然后保持其他设置不变重新运行。
参考视频是否需要与最终的宽高比和时长一致?
在模型层面不一定需要,因为视频片段可能仅提供动作或相机节奏。然而,当构图很重要时,更紧凑的取景可以减少歧义。将参考视频裁剪到有用的动作,说明要遵循哪一部分,并在生成界面中设置最终的宽高比和时长,而不是假设源视频片段会决定它们。
值得保留的参考是那些有明确任务的参考。如果移除一个文件对您的简报没有任何改变,那么在下一次生成中就不要包含它。