第一次使用 H3 Max,先给自己设定一个明确的终点:完成一条能下载、能检查、能放进剪辑工程的短镜头。比如让桌上的商品保持不动,镜头轻轻向前推进。画面足够简单,你才容易发现具体问题。

先确认模型版本: 查看 H3 Max 与 Turbo 的模型介绍和样例,或打开 标准 MiniMax H3 的模型介绍和样例。本文讨论的是 H3 Max;标准 H3 是不同版本,请分别查看对应页面的控制项,不要直接套用本文的参数或速度结论。

这篇 H3 Max 使用教程按实际操作顺序,介绍 fal 上的文生视频和图生视频流程。参数依据 2026 年 9 月 4 日核对的官方页面;文中的提示词是原创练习示例,不代表我们已经用它们跑出实测成片。

用 AI 制作的蓝色陶瓷杯参考图片示例

这张 AI 制作的图片用于演示陶瓷杯练习的输入素材,不是 fal 产品界面截图,也不是 H3 Max 生成的视频画面。

1. 选好输入素材,打开对应入口

如果只有文字构想,打开 H3 Max 文生视频;如果已经有想保留主体和构图的照片,打开 H3 Max 图生视频

确认页面路径对应 H3 Max,按页面提示登录,并在提交前查看当前价格或可用额度。fal 的费用与 FreyaVideo 积分分开计算。也可以查看 FreyaVideo 的 H3 Max 模型与实测样例。下文使用 fal 的界面字段;FreyaVideo 是否开放生成,请以模型页当前状态为准。

此时就确定用途:网站中的横向展示,还是社交平台的竖向内容?不要等生成完再决定,因为它会直接影响照片裁切和主体在画面中的位置。

2. 用一组简单参数开始

进入文生视频输入表单,替换页面里的示例提示词,然后用下面这组起始参数:

页面控件 第一次建议 先解决什么问题
Duration 5 秒 只检查一个动作
Resolution 768P 保持一致的检查尺寸
Prompt Expansion Mode balanced 先用较快的提示词扩写
Aspect Ratio 16:9 或 9:16 提前确定横屏或竖屏

文生视频接口文档说明,balanced 扩写大约需要 1 秒,quality 可能用约 30 秒丰富提示词。这属于渲染前的准备时间。等有了基准结果,再尝试 quality 做对照;名称并不意味着它一定更适合你的镜头。

官方模型介绍列出的能力包括 5 至 15 秒时长、原生 480P 或 768P,以及与画面同步生成的原生音频。不要把标准版 H3 教程中的设置直接套过来。

第一次不必指定 seed。把原始提示词和参数另存一份,后面的修改才有可以比较的起点。

3. 把提示词写成一个可验收的镜头

按“主体—动作—镜头—光线—声音”组织信息,不必堆砌一长串风格词。下面是一段可以尝试的英文商品镜头提示词:

A matte blue ceramic mug sits on an oak kitchen table beside a window. A thin stream of steam rises gently. The camera makes a slow, short push toward the mug, keeping its shape and handle visible. Soft morning light, quiet room ambience, no speech. One continuous shot.

它要求的是:窗边木桌上的蓝色陶瓷杯,少量蒸汽缓缓上升,镜头短距离向前推进,保持杯身和把手可见;用清晨柔光和安静的室内环境声,不出现讲话,全程一个连续镜头。

用 AI 制作的同一陶瓷杯逐步推近三景别故事板

轻微推进镜头的故事板示意图,不是 H3 Max 输出。这三个景别帮助说明构图变化,不是从生成视频中截取的连续帧。

点击提交前,先写好三条验收标准:杯子始终只有一个正常连接的把手;推进动作连续;没有意外人物进入画面。这是你判断结果的标准,不是模型会完全遵守的保证。

提交一次后,保留当前任务并等待。如果比预期慢,先查这次任务的状态,再决定是否重新付费生成。仅凭等待时间长,无法判断前一次是否已经失败。

4. 想保留初始外观,就从照片开始

图生视频先准备一张清晰的照片,完整露出主体。按最终用途裁好宽高比,去掉边缘干扰,并给预期的镜头运动留出空间。商品过小、背景过杂,都会让细节验收更困难。

在图生视频页面的 Image URL 位置添加照片。图生视频接口文档中对应的字段是 image_url,这张首帧图也决定输出宽高比。第一轮先让 End Image URL 保持空白。

如果照片是一只玻璃瓶,可以尝试这段原创运动提示词:

Keep the bottle upright in its current position. Make a very small camera push-in while a soft reflection moves across the glass. Preserve the bottle silhouette, cap, and existing label layout. Keep the background still. Quiet studio ambience, no dialogue, one continuous shot.

这段话让瓶子保持直立,只做非常轻微的镜头推进,同时让柔和反光掠过玻璃;要求保留轮廓、瓶盖与原有标签布局,背景不动,声音保持安静。

照片提供初始外观,文字说明希望发生的运动。如果只有正面照片,却又要求包装细节准确,先别安排绕到背面的环绕镜头:未拍到的部分仍然需要模型自行补全。

5. 确实需要指定转场,再添加尾帧

可选字段 end_image_url 用来引导最后一帧。第一次尝试首尾帧时,选择同一主体、能够自然衔接的两种构图,例如从中景过渡到稍近一点的景别。

先把两张图整理成相同宽高比,再比较主体位置、背景与光线。如果三者都发生很大变化,任务就不只是简单运动,还包含场景转换。

End Image URL 添加第二张图,并在提示词里说明希望如何从起点移动到终点。文字与图片要一致:如果尾帧是近景,就不要同时要求镜头后退到全景。

检查时尤其注意过渡中段。即使最后到了正确位置,途中出现瓶身弯曲,也不能算可用的商品镜头。

6. 检查画面、声音和下载文件

先从头到尾正常播放一次,再拖动查看开头、中间、结尾,重点看轮廓、标签、把手、瓶盖和背景。最后按实际发布尺寸检查构图,确认商品和后期字幕都有合适的空间。

声音要单独听一遍,留意意外讲话、突然的响声或喧宾夺主的音乐。下一轮可以补上更具体的声音说明,例如“quiet room tone, no dialogue”。如果计划另配音乐,就在剪辑软件里静音或替换生成音轨。

确认自己的任务完成后,再使用对应结果的下载链接。把文件保存到本地,并从头到尾播放;浏览器里能预览,还不代表文件交付检查已经完成。核对时长、构图和声音,把提示词、输入图片、参数以及任务标识一并保留。

7. 根据具体问题,只改一个重点

遇到的问题 下一次优先改什么
商品变形或漂移 减少运动,换更清晰、干扰更少的首帧图
镜头移动太远 把镜头句改成轻微推进,或固定机位
首尾帧衔接生硬 缩小构图差异,让两张图光线更一致
标签或标志改变 降低运动幅度,必要时后期叠加准确图形
声音不符合预期 简化声音指令,或在剪辑时替换音轨
任务一直等待 先检查已有任务状态,再决定是否重新提交
视频下载失败 先重试已完成结果的下载,不要马上付费重生成

保留每一轮结果,对照同一个缺陷看是否改善。一次同时更换照片、动作、镜头和时长,即使下一条更好,也很难知道究竟是哪一项起了作用。

下一步:比较模型,或完成站内照片动画

如果还在选模型,继续看 H3 Max 与 Kling 对比;如果关心从提交到可用结果究竟要等多久,可以看 AI 视频生成速度指南

准备好镜头构想后,先到 H3 Max 模型页查看参数和真实样例。若页面提示生成暂不可用,可以在图生视频工具选择当前可用模型;每次提交前检查参数与积分预估。

常见问题

在哪里可以使用 H3 Max?

FreyaVideo 已有 H3 Max 模型页,可查看参数与实测样例。能否生成以页面当前显示的可用状态为准;生成前请核对所选模型和积分预估。本文的分步操作使用 fal,其账户和费用与 FreyaVideo 分开。

第一次应该用什么参数?

建议从 5 秒、768P 分辨率和 balanced 提示词扩写开始。只保留一个主体和一种镜头运动,方便判断下一次需要修改什么。

首帧和尾帧图片分别有什么作用?

在图生视频接口中,image_url 提供首帧并决定输出宽高比,可选的 end_image_url 用来引导最后一帧。这些控制并不保证商品的每个细节都保持完全一致。

H3 Max 可以原生生成 1080p 或 2K 吗?

本文核对的 H3 Max 接口提供原生 480P 和 768P,时长范围为 5 至 15 秒。标准版 MiniMax H3 是另一款模型,不能直接套用它的参数。