限时优惠 9 月 4 日 - 9 月 11 日
Seedance 2.5 现已支持 1080P - 获取 免费生成 + 节省 低至 4 折(省 60%),尊享 VIP 极速。
立即获取
限时优惠 9 月 4 日 - 9 月 11 日
GPT Image 2.5 现已上线。解锁 365 天无限使用额度
立即获取
All posts
Share this post
Step-by-step guide showing how to use MiniMax H3 to generate cinematic AI videos from text prompts
MiniMax H3

如何使用 MiniMax H3:新手入门指南

On this page

一个 MiniMax H3 视频结合了两个时间线:画面和声音。在没有音频的情况下让画面保持清晰,然后使用声音来增强它。

本新手指南涵盖了一个实用的工作流:选择一种模式、为每个参考分配一个角色、描述屏幕上应该出现的内容,并一次优化一个元素。

什么是 MiniMax H3?

MiniMax H3 是来自 MiniMax 的通用多模态生成模型。MiniMax H3 官方发布公告指出,它可以在一个上下文中理解文本、图像、视频和音频,然后生成长达 15 秒、2K 分辨率且带有原生立体声的视频。
了解如何通过结合视频、图像和音频输入来使用 MiniMax H3 多模态功能
图像可以定义角色,视频可以演示镜头移动,音频可以引导声音或节奏。书面指令告诉 H3 这些源素材与新视频之间的关系。

在使用 MiniMax H3 之前你需要准备什么

定义你的场景和输出目标

在收集文件之前,先描述一个完成的镜头。包括主体、动作、镜头、格式和声音目标。“一个 6 秒的垂直剪辑,一个陶瓷杯在桌子上缓慢旋转,镜头固定,带有柔和的环境音”比“制作一个电影感的产品视频”更容易评估。

选择一个成功条件:可读的标签、稳定的面部、特定的镜头移动或匹配的对话。第一次生成应该回答一个问题,而不是尝试完成整个营销活动。

准备文本、图像、视频或音频资产

仅使用具有明确角色的源素材。一个简单的资产映射可以防止一个文件意外控制结果中错误的部分:

资产 分配的任务 忽略的内容
图像 1 主体外观和服装 镜头运动
视频 1 镜头路径和节奏 主体身份
音频 1 声音或音乐节奏 视觉风格
解释如何使用 MiniMax H3 进行多资产视频创建和编辑的四步教程
Hailuo AI 的当前 MiniMax H3 模型页面记录了文本生成视频、首帧、首尾帧以及 Omni Reference 工作流。它支持多个媒体参考,但请以登录后的 Loova AI 界面作为当前文件限制的来源。

仅上传您有权使用的材料,并将机密资产或敏感个人数据排除在工作流之外。声音、私人镜头和可识别的人物在成为参考材料之前需要获得适当的同意。

如何在 Loova 上使用 MiniMax H3

打开 MiniMax H3 生成器

展示如何使用带有提示词输入和参考选项的 MiniMax H3 的仪表盘界面
打开 Loova AI 上的 MiniMax H3 生成器。在添加媒体之前,确认已选择 MiniMax H3,因为另一个模型可能会显示不同的模式、设置或参考限制。

选择生成模式

使模式与任务相匹配。对于仅提示词的生成,使用文本生成视频;当图像必须是边界帧时,使用首帧或首尾帧。当媒体提供身份、动作、声音、氛围或剪辑方向时,选择参考工作流。

添加并分配参考

添加覆盖镜头所需的最少集合。使用界面标签并说明每个角色:“图像 1 仅定义杯子形状和釉面;视频 1 定义缓慢的顺时针镜头移动。”如果两个源素材发生冲突,请移除一个或说明优先级。

编写场景指令

写下随着时间的推移应该看到和听到的内容。为每个参考分配一个特定的任务,并像导演画面一样刻意地导演声音。

使用这个入门结构:

输出:6 秒,9:16
主体:[谁或什么必须保持可识别]
场景:[位置、光线和构图]
0-2秒:[第一个可见动作]
2-6秒:[镜头和主体移动]
参考:图像 1 控制 [任务];视频 1 控制 [任务]
声音:[对话、环境音、音效或音乐]
保持不变:[关键面部、产品、文本或颜色]

更倾向于可见的方向。“镜头向前移动,同时标签保持朝前”定义了一个镜头;“让它高端且引人入胜”则没有。

选择设置并生成

显示如何使用 MiniMax H3 设置宽高比和 2K 分辨率的配置面板
选择最短的有用时长、目标比例和可用分辨率。MiniMax 描述的输出长达 15 秒和 2K,但模型页面上可见的控制是您账户和模式的限制。

移除冲突的方向,生成,并保留第一个输出作为对照。不要同时更改模式、参考、时长和提示词。

如何审查和优化结果

检查视觉、动作和声音的准确性

通过三种方式观看剪辑:正常播放、静音播放以及关注最后一帧。检查主体身份、手部、产品文本、背景稳定性、镜头路径、剪辑、对话、音效和立体声平衡。一个在有音频时感觉生动的剪辑,在静音时可能仍然动作不清晰;一个强大的首帧到最后可能仍然会漂移。

将结果与您的那一个成功条件进行比较。用具体的语言记录一个不匹配,例如“三秒后杯柄改变了形状”,而不是“视频看起来不对”。

修改不成功的元素

更改导致该不匹配的指令,并保持其余部分固定。缩短拥挤的动作描述,澄清一个参考角色,减少镜头移动,或说明必须保持不变的细节。返回相同的 MiniMax H3 工作流,以便第二个版本与第一个版本保持可比性。
视频编辑器界面,详细介绍了如何使用 MiniMax H3 进行精确的对象移除和编辑

创建您的第一个 MiniMax H3 视频

从一个镜头开始,不超过定义它所需的参考,以及一个您可以检查的条件。在生成之前保存提示词和资产角色映射。在第一个结果出来后,仅修改失败的元素,并从同一个起始帧到最终声音对比两个版本。

在 Loova AI 上使用 MiniMax H3 进行创作

将一个真实的场景创意带到 MiniMax H3 AI 视频生成器,为每个参考分配一个特定的任务,并生成您可以清晰判断的最简版本。

MiniMax H3 的限制与权衡

多模态的灵活性也创造了更多让指令产生冲突的方式。更多的参考并不自动产生更多的控制,2K 输出也不能保证每个镜头中稳定的文本、身份、物理或剪辑。原生立体声可以减少对单独音频生成步骤的需求,但它在审查中增加了对话、节奏、环境音和混音准确性。

生成时间、可用模式、文件限制和账户访问权限可能会随当前界面而变化。将模型和平台页面视为第一方描述,而不是特定提示词会可靠重复的证据。对于客户或公开工作,逐帧审查导出的视频,确认输入权利,并在发布前检查当前的平台规则。

常见问题

为什么 MiniMax H3 的生成时间比预期的要长?

更长、更高分辨率或多参考的请求需要更多的处理,并且排队情况会有所不同。不要立即提交相同的任务。如果任务挂起的时间超过了界面估计的时间,请保存提示词和设置,捕获状态和时间,然后在再次尝试之前联系支持团队。

我可以单独下载原始立体声音轨吗?

MiniMax 记录了视频中的原生立体声,而公共模型页面目前描述的是下载结果,而不是单独的原始音轨。检查登录后的导出菜单。如果没有出现仅音频选项,请在您的权利允许的情况下,在编辑器中从下载的视频中提取音轨。

未完成的 MiniMax H3 项目会自动保存在 Loova 上吗?

公共 MiniMax H3 页面不承诺自动保存未完成的草稿。在离开前,将您的提示词、参考角色和设置复制到本地。对于已提交的任务,请检查您登录后的生成历史;如果不存在,请将保存的详细信息和截图发送给支持团队。

如果上传或生成过程失败,我该怎么办?

检查上传器显示的格式、大小、时长和参考数量。使用一个受支持的文件、更短的提示词和简单的文件名重试。一次添加回一个资产;如果错误仍然存在,请将其记录下来以寻求支持,而不是重复上传私人材料。

双轨检查也是记住如何使用 MiniMax H3最清晰的方法:决定观众必须看到什么以及他们必须听到什么。当两者在生成前都很具体时,第一个结果就会成为一个有用的草稿,而不是一个昂贵的谜团。