
MiniMax H3 评测:功能与质量测试
On this page
MiniMax H3 最强有力的公开证据已经过筛选,随时准备给人留下深刻印象。这些样本可以展示该模型的能力,但无法揭示普通生成达到相同标准的可靠性。
在这篇评测中,我将每个演示都视为审计材料:将其参考内容与采样帧进行对比,检查交付的媒体文件,并将未经验证的重试表现排除在结论之外。
MiniMax H3 评测一览
MiniMax 将 H3 作为通用多模态生成模型推出,而官方的 H3 仓库现在记录了其输入、输出模式和本地检查点。喜欢托管界面的创作者可以通过 Loova AI 访问 MiniMax H3 AI 视频生成器。
MiniMax H3 的设计初衷

H3 将文本、图像、视频和音频视为一个相互关联的简报。提示词可以识别产品图像、动作剪辑和音频参考,然后同时生成画面和原生立体声。
官方规范支持最多 9 张图像、3 个参考视频和 3 个音频剪辑,混合输入上限为 12 个文件。它还支持文本转视频、首帧或尾帧控制、成对关键帧以及参考转视频的工作流。这些是提供商的规范,而非独立的质量调查结果。
H3 Base 生成 768p 分辨率。官方的 2K 工作流会结合原始上下文重新生成该结果,从而增加了一个制作和计费步骤。
我们如何测试 MiniMax H3

本文链接到了 Loova AI 的托管 H3 路径。本次评测没有提交新的生成任务,也没有获得 MiniMax 的评测额度;它审计了公开的 MiniMax 和 Loova AI 样本。我们将源参考与输出帧进行了对比,在一段 15 秒的品牌视频中抽取了 6 个帧,并检查了下载的媒体元数据。
这种方法可以评估可见的参考使用情况、时间稳定性和交付的媒体格式。它无法确定首次成功率、审核行为、排队时间或平均重试次数。
测试设置和评估标准
为了进行可重复的试验,请打开当前的 MiniMax H3 模型页面,并使用一个固定的资产包进行三次运行。对参考保真度、产品稳定性、动作、音频和编辑可用性进行评分。保存提示词、设置、日期和额度预览。
仅上传您获得授权使用的产品文件、人脸、声音和素材。当参考内容旨在保留到输出中时,同意和源授权就显得尤为重要。
MiniMax H3 质量测试
产品参考视频测试
已发布的品牌样本使用四张源图像来确立双筒望远镜形状的眼镜、米黑红配色方案以及“MINIMAX”标识。在其 15 秒输出的六个采样点中,这些元素在规划的位置重复出现。这支持了参考包的解读。
这并不能证明 H3 会根据需要保留真实的包装。输入内容类似于分镜脚本帧,而一个展示并不能说明被拒绝的镜头。在三次运行中测试一个非对称产品、小标签和固定色板;拒绝接受轮廓、标签位置或颜色的改变。

动作传递测试
MiniMax 发布的示例显示参考视频被用于引导动作或相机行为。然而,当样本中还包含多个角色和风格参考时,动作传递的贡献就无法被孤立出来。
使用一个获得授权的 4 到 6 秒源剪辑、一个角色和一个静态背景。对姿势时机、肢体路径、构图、身份和背景稳定性进行评分。左右分屏播放或叠加播放可以暴露时间偏差。
对话与立体声音频测试
为本次评测检查的公开样本文件包含双声道 AAC 音频。这证实了这些演示交付时带有立体声轨道;但它并不能证明有意义的左右声场定位、清晰的对话或可靠的口型同步。
一个有用的测试是将两个说话者放在固定画面的两侧,每个人有不同的对话和方向性声音线索。分别审查文本、说话者分配、嘴型时机、声道放置和环境音。
MiniMax H3 的优缺点

优点
- 混合参考可以在一个简报中描述主体、场景、动作和声音。
- 4–15 秒的时长范围比单一固定剪辑长度更具灵活性。
- 原生立体声音频为对话和环境音创造了一个合理的起点。
- 已发布的 Base 检查点为技术团队提供了一条本地 768p 路径。
缺点
- 公开展示的质量无法揭示平均重试次数。
- 密集的参考包使故障诊断变得更加困难。
- 准确的小文本、包装几何形状和多镜头连续性仍需要针对特定项目进行测试。
- 本地 Base 部署不包括托管的 Context-IR 或完整的 2K 重新生成模块。
制作成本与重试考量

截至 2026 年 8 月 13 日,MiniMax 的直接 API 目录价格为:768p 输出每秒 0.08 美元,2K 输出每秒 0.13 美元。前五张参考图像免费,额外的图像每张 0.04 美元,参考视频按其在所选分辨率下的时长计费。这些数据来自官方的按需付费定价页面,可能会发生变化。
因此,一个 15 秒的 2K 输出起价为 1.95 美元。在不计入收费参考内容的情况下,尝试三次的成本为 5.85 美元。加上一个 6 秒的 2K 参考视频,每次尝试的成本达到 2.73 美元,三次尝试则为 8.19 美元。更实用的规划公式是:
采纳镜头成本 = 总生成和参考费用 ÷ 批准的镜头数
Loova AI 使用自己的额度系统,因此请勿将 MiniMax API 的美元费率直接套用到该路径。在批准批量预算之前,记录显示的额度预览、失败运行的处理方式以及实际重试次数。
谁应该使用 MiniMax H3?
H3 是产品概念、风格化品牌视频、动作主导场景或对话剪辑的强有力试点候选。它也适合能够支持本地部署的开发人员。
如果每个标签都必须精确无误、吞吐量必须可预测,或者机密参考内容无法进入托管服务,请选择等待。这些工作需要私有测试集和经过验证的数据路径。
最终结论

在本次 MiniMax H3 性能评测中,最强大的部分是工作流设计:一个上下文可以连接参考、动作和立体声音频,而长达 15 秒的时长为完整的节奏留出了空间,而不是微镜头。
局限性在于证据。已发布的 MiniMax H3 视频示例表明该模型可以产生连贯、有野心的结果,但它们并未透露需要尝试多少次。MiniMax H3 值得用您自己最难的资产进行一次三次运行的试点,而不是仅凭演示就做出全生产线的承诺。
常见问题
MiniMax H3 与海螺 3.0 或海螺 AI 是一样的吗?
不完全一样。MiniMax H3 是模型名称。海螺 AI(Hailuo AI)是 MiniMax 面向创作者的视频平台,官方 H3 仓库将其列为在线应用路径。“海螺 3.0”并不是当前 H3 文档中使用的模型名称。在比较价格、设置或结果时,请使用准确的模型标签。
MiniMax H3 可以在本地运行吗?还是只能通过 Loova AI 等平台使用?
它可以在本地运行,但有一个重要的限制。MiniMax 已经发布了用于首/尾帧和参考转视频生成的 H3 Base 检查点,并提供了对 SGLang、vLLM、Diffusers 和 ComfyUI 的支持路径。其示例 SGLang 部署使用四个 GPU。托管的 Context-IR 和 2K 重新生成模块不包括在内,因此本地 768p Base 输出与完整的托管工作流并不相同。
生成的 MiniMax H3 视频存储在哪里?保存多长时间?
Loova AI 目前没有公布生成的 MiniMax H3 视频的固定存储期限。请在每个批准的输出准备就绪后立即下载,然后将视频、源资产、提示词和设置存储在您自己的项目文件夹中。如果项目涉及机密资产并需要特定的保留或删除计划,请在上传文件前与 Loova AI 客服确认这些细节。
Loova AI 版本的 MiniMax H3 多久更新一次?
当前模型页面上没有说明公开的固定更新计划。对于生产工作,请保存一个 5 秒的控制项目,并记录其日期、模型标签、设置和输出。当模型标签、可用控制或额度预览发生变化时重新运行它;这可以为您提供回归检查,而不是假设每次“H3”生成都使用未改变的路径。
这留下了一个真正的未知数:不是 H3 能否制作出一个令人信服的剪辑,而是您自己的参考包多久能让下一个剪辑同样可用。
运行受控的 MiniMax H3 试点
使用一个获得授权的参考包和一个固定的提示词打开 MiniMax H3 AI 视频生成器。生成三次尝试,按照相同的五个标准对其进行评分,并在扩大工作流规模之前计算采纳镜头的成本。