限时优惠 9 月 4 日 - 9 月 11 日
Seedance 2.5 现已支持 1080P - 获取 免费生成 + 节省 低至 4 折(省 60%),尊享 VIP 极速。
立即获取
限时优惠 9 月 4 日 - 9 月 11 日
GPT Image 2.5 现已上线。解锁 365 天无限使用额度
立即获取
All posts
Share this post
Infographic guide showing how the Seedance 2.5 multi reference workflow combines images for results
AI 模型Seedance 2.5

Seedance 2.5 多参考图/视频/音频指南

On this page

一张清晰的人像、一张精美的场景静止图,以及一段快速的相机剪辑,都可能将同一个视频引向不同的方向。问题很少在于某一个参考不够好,而在于这组参考之间缺乏层级关系。

我是 Mira。在组合参考之前,我想知道哪个文件决定角色面部,哪个决定场景设置,哪个被允许影响动作。本篇 **Seedance 2.5 多参考(multi reference)**指南将向您展示如何在生成视频之前构建这个清晰的角色分工图。

什么是 Seedance 2.5 中的多参考?

多参考生成是指将多个素材资产作为一个视频创意简报来使用。图片可以定义主体和场景,视频可以演示动作,而音频则可以引导配音或节奏。提示词则明确指出要从每个素材中借鉴什么。

字节跳动(ByteDance)表示,Seedance 2.5 每次生成最多支持 30 张图片、10 个视频片段和 10 个音频片段。其官方多参考示例将图片分别分配给演员、乐器、场地和观众区域。具体平台的使用权限可能会有所限制。
Dreamina 网页界面展示了用于视频创作的 Seedance 2.5 50 多模态参考指南
目前的 Loova AI 参考图生成视频工作区公开显示了多图上传功能,但并未包含 Seedance 2.5 的所有视频或音频选项。请以您登录后的实际控制面板作为操作边界。

为每项任务选择合适的参考

从能够涵盖外观、地点、动作和声音的最小素材集开始。如果两个文件控制同一个特征,请选择其中一个,或者解释它们之间的关系。

参考素材 赋予其这项任务 排除在其任务之外
@Image 1 角色面部、发型、服装 背景和姿势
@Image 2 产品形状、标签、颜色 光照和相机角度
@Image 3 地点和一天中的时间 角色身份
@Video 1 动作和相机节奏 主体外观
@Audio 1 声音或节奏 视觉风格

角色和产品参考

使用能够清晰看到关键细节的视角。如果多张图片展示同一个主体,请予以说明:@Images 1–3 展示了同一款瓶子的正面、侧面和背面。请仅生成一个瓶子。 仅命名必须保持一致的角色特征。

不要让一张图片同时控制身份、姿势、地点、光线和风格,除非所有这些元素都需要同时迁移。
对比多个怪物输入使用 Seedance 2.5 多参考生成融合输出场景的效果

地点和风格参考

地点参考可以确立布局、天气或光线;风格参考可以确立色调或纹理。如果一张图片同时具备这两者,请缩小其作用范围:@Image 4 仅定义咖啡馆吧台、窗户布局和温暖的晨光。

当您只需要其色彩氛围时,避免使用“复制此图片”这类宽泛的指令。

动作和相机参考

在支持的情况下,使用视频来控制动作节奏、相机轨迹、过渡或调度:@Video 1 仅定义缓慢的顺时针环绕和节奏;将其应用于 @Image 1 的产品。

如果视频的唯一任务是提供动作,那么视频画面中不需要包含相同的主体。将其裁剪到相关的动作片段即可。

配音和音频参考

在可用时,音频可以定义声音、环境音或时机。分配一个明确的目的:@Audio 1 仅定义说话者的声音。 对话语言需单独说明。

请使用您获得授权的音频。即使视觉角色是虚构的,使用辨识度高的声音也可能会引发授权和冒充方面的顾虑。

如何在 Loova AI 上创建多参考视频

公开页面列出了多图上传、提示词输入框以及其他设置。可用的控制选项可能取决于您的账户类型。

选择必要的素材资产

Seedance 2.5 多参考输入展示了一组管弦乐队乐手和乐器的参考照片
从一个主要主体开始,仅添加文字无法可靠描述的内容。一个产品场景可能需要产品、地点和第二个角度,而不是一个完整的灵感板。在上传之前,请确认客户工作、人脸或声音的许可,删除机密或敏感的个人数据,并仔细阅读当前的使用条款隐私政策

为每个参考分配角色

在编写场景方向之前,先写下角色分工图。例如:

@Image 1 定义了在每个镜头中相同角色的面部、发型和绿色夹克。@Image 2 仅定义书店书架和窗户光线。@Image 3 仅定义红色笔记本。角色走进书店,在桌子上找到了笔记本,并将其贴在夹克上。保持她的身份、服装和笔记本设计不变。

使用界面上的文件标签;保持每个文件与任务之间的一对一关联。

定义必须保持一致的内容

最后写一个简短的保留清单,仅涵盖那些一旦发生偏差就会导致结果无法使用的细节。

分工图明确后,在 Loova AI 参考图生成视频中构建您的第一个多图视频。提交最小的可行参考集,在添加另一个素材之前先评估一致性。

如何保持角色和产品的一致性

Seedance 2.5 多参考演示将特定的珠宝首饰合成到时尚模特输出图像上
一致性在撰写提示词之前就已经开始。参考素材在发型、服装、包装、比例和颜色上应当保持一致。不同的标签或配饰会产生设计冲突,而不是提供额外的参考依据。

在相关联的镜头中使用相同的核心参考集,保持名称和文件角色稳定,并将变化描述为动作,而不是重新设计。对于产品,当精确的几何形状或文字至关重要时,避免进行变形。对于角色,说明谁拿着哪个物体以及每个人站在哪里,这样身份就不会是唯一稳定的特征。

如何解决冲突或被忽略的参考

首先诊断被忽略的任务,而不是被忽略的文件。如果地点错误,保持角色参考不变,并缩小地点指令。如果面部发生偏差,移除多余的风格图片,并强化角色角色。

使用以下修复顺序:

  1. 移除任何没有独特任务的参考。
  2. 解决文件之间的视觉矛盾。
  3. 将主要主体放在首位,并对其进行精确标记。
  4. 修改一项角色指令,然后使用相同的设置重新生成。
  5. 权重不足的参考可能只是在与更显著的指令竞争。增加重复并不总是解决办法,更清晰的优先级通常才是。

多参考的限制与权衡

多视角时尚参考照片,附带用于详细 Seedance 2.5 多参考生成的提示词示例
模型的最大容量并不是推荐的使用目标。更多的素材会增加设置时间,并创造更多导致面部、色调、背景或动作线索冲突的机会。一个聚焦的素材集更容易调试和重复使用。

平台限制也可能与字节跳动的模型规范有所不同。Loova AI 目前公开的参考图生成视频页面列出的 JPG、PNG 和 WEBP 图片大小上限为每张 10MB,最小尺寸为 300×300px。该页面未公开列出视频/音频格式或其大小限制;在准备这些素材之前,请检查实时上传器的提示。

常见问题

Seedance 2.5 接受哪些文件格式和大小限制的参考素材?

在模型层面,字节跳动确认支持图片、视频和音频参考。在 Loova AI 当前的参考图生成视频页面上,公布的图片规则为 JPG、PNG 或 WEBP,每张大小不超过 10MB,最小尺寸为 300×300px。该公开页面上未说明视频和音频格式限制,因此请遵循实时上传器的验证消息。

我可以重复使用以前 Loova AI 项目中的参考文件吗?

公开的 Loova AI 参考工作区目前未记录跨项目素材重复使用的功能。请检查您登录后的项目或素材选择器是否显示了早前上传的内容。如果没有,请保留一个文件名稳定的本地参考包,并仅重新上传新场景所需的已批准文件。

为什么我上传的其中一个参考被忽略或权重不足?

它可能与另一个参考重复、与更强的指令冲突,或者缺乏指定的角色。移除没有独特任务的文件,准确说明要从被忽略的素材中提取什么,并将无关的背景或风格元素排除在其角色之外。然后保持其他设置不变重新运行。

参考视频是否需要与最终的宽高比和时长一致?

在模型层面不一定需要,因为视频片段可能仅提供动作或相机节奏。然而,当构图很重要时,更紧凑的取景可以减少歧义。将参考视频裁剪到有用的动作,说明要遵循哪一部分,并在生成界面中设置最终的宽高比和时长,而不是假设源视频片段会决定它们。

值得保留的参考是那些有明确任务的参考。如果移除一个文件对您的简报没有任何改变,那么在下一次生成中就不要包含它。