第一次使用 H3 Max,先给自己设定一个明确的终点:完成一条能下载、能检查、能放进剪辑工程的短镜头。比如让桌上的商品保持不动,镜头轻轻向前推进。画面足够简单,你才容易发现具体问题。
先确认模型版本: 查看 H3 Max 与 Turbo 的模型介绍和样例,或打开 标准 MiniMax H3 的模型介绍和样例。本文讨论的是 H3 Max;标准 H3 是不同版本,请分别查看对应页面的控制项,不要直接套用本文的参数或速度结论。
这篇 H3 Max 使用教程按实际操作顺序,介绍 fal 上的文生视频和图生视频流程。参数依据 2026 年 9 月 4 日核对的官方页面;文中的提示词是原创练习示例,不代表我们已经用它们跑出实测成片。

这张 AI 制作的图片用于演示陶瓷杯练习的输入素材,不是 fal 产品界面截图,也不是 H3 Max 生成的视频画面。
1. 选好输入素材,打开对应入口
如果只有文字构想,打开 H3 Max 文生视频;如果已经有想保留主体和构图的照片,打开 H3 Max 图生视频。
确认页面路径对应 H3 Max,按页面提示登录,并在提交前查看当前价格或可用额度。fal 的费用与 FreyaVideo 积分分开计算。也可以查看 FreyaVideo 的 H3 Max 模型与实测样例。下文使用 fal 的界面字段;FreyaVideo 是否开放生成,请以模型页当前状态为准。
此时就确定用途:网站中的横向展示,还是社交平台的竖向内容?不要等生成完再决定,因为它会直接影响照片裁切和主体在画面中的位置。
2. 用一组简单参数开始
进入文生视频输入表单,替换页面里的示例提示词,然后用下面这组起始参数:
| 页面控件 | 第一次建议 | 先解决什么问题 |
|---|---|---|
| Duration | 5 秒 | 只检查一个动作 |
| Resolution | 768P | 保持一致的检查尺寸 |
| Prompt Expansion Mode | balanced | 先用较快的提示词扩写 |
| Aspect Ratio | 16:9 或 9:16 | 提前确定横屏或竖屏 |
文生视频接口文档说明,balanced 扩写大约需要 1 秒,quality 可能用约 30 秒丰富提示词。这属于渲染前的准备时间。等有了基准结果,再尝试 quality 做对照;名称并不意味着它一定更适合你的镜头。
官方模型介绍列出的能力包括 5 至 15 秒时长、原生 480P 或 768P,以及与画面同步生成的原生音频。不要把标准版 H3 教程中的设置直接套过来。
第一次不必指定 seed。把原始提示词和参数另存一份,后面的修改才有可以比较的起点。
3. 把提示词写成一个可验收的镜头
按“主体—动作—镜头—光线—声音”组织信息,不必堆砌一长串风格词。下面是一段可以尝试的英文商品镜头提示词:
A matte blue ceramic mug sits on an oak kitchen table beside a window. A thin stream of steam rises gently. The camera makes a slow, short push toward the mug, keeping its shape and handle visible. Soft morning light, quiet room ambience, no speech. One continuous shot.
它要求的是:窗边木桌上的蓝色陶瓷杯,少量蒸汽缓缓上升,镜头短距离向前推进,保持杯身和把手可见;用清晨柔光和安静的室内环境声,不出现讲话,全程一个连续镜头。

轻微推进镜头的故事板示意图,不是 H3 Max 输出。这三个景别帮助说明构图变化,不是从生成视频中截取的连续帧。
点击提交前,先写好三条验收标准:杯子始终只有一个正常连接的把手;推进动作连续;没有意外人物进入画面。这是你判断结果的标准,不是模型会完全遵守的保证。
提交一次后,保留当前任务并等待。如果比预期慢,先查这次任务的状态,再决定是否重新付费生成。仅凭等待时间长,无法判断前一次是否已经失败。
4. 想保留初始外观,就从照片开始
图生视频先准备一张清晰的照片,完整露出主体。按最终用途裁好宽高比,去掉边缘干扰,并给预期的镜头运动留出空间。商品过小、背景过杂,都会让细节验收更困难。
在图生视频页面的 Image URL 位置添加照片。图生视频接口文档中对应的字段是 image_url,这张首帧图也决定输出宽高比。第一轮先让 End Image URL 保持空白。
如果照片是一只玻璃瓶,可以尝试这段原创运动提示词:
Keep the bottle upright in its current position. Make a very small camera push-in while a soft reflection moves across the glass. Preserve the bottle silhouette, cap, and existing label layout. Keep the background still. Quiet studio ambience, no dialogue, one continuous shot.
这段话让瓶子保持直立,只做非常轻微的镜头推进,同时让柔和反光掠过玻璃;要求保留轮廓、瓶盖与原有标签布局,背景不动,声音保持安静。
照片提供初始外观,文字说明希望发生的运动。如果只有正面照片,却又要求包装细节准确,先别安排绕到背面的环绕镜头:未拍到的部分仍然需要模型自行补全。
5. 确实需要指定转场,再添加尾帧
可选字段 end_image_url 用来引导最后一帧。第一次尝试首尾帧时,选择同一主体、能够自然衔接的两种构图,例如从中景过渡到稍近一点的景别。
先把两张图整理成相同宽高比,再比较主体位置、背景与光线。如果三者都发生很大变化,任务就不只是简单运动,还包含场景转换。
在 End Image URL 添加第二张图,并在提示词里说明希望如何从起点移动到终点。文字与图片要一致:如果尾帧是近景,就不要同时要求镜头后退到全景。
检查时尤其注意过渡中段。即使最后到了正确位置,途中出现瓶身弯曲,也不能算可用的商品镜头。
6. 检查画面、声音和下载文件
先从头到尾正常播放一次,再拖动查看开头、中间、结尾,重点看轮廓、标签、把手、瓶盖和背景。最后按实际发布尺寸检查构图,确认商品和后期字幕都有合适的空间。
声音要单独听一遍,留意意外讲话、突然的响声或喧宾夺主的音乐。下一轮可以补上更具体的声音说明,例如“quiet room tone, no dialogue”。如果计划另配音乐,就在剪辑软件里静音或替换生成音轨。
确认自己的任务完成后,再使用对应结果的下载链接。把文件保存到本地,并从头到尾播放;浏览器里能预览,还不代表文件交付检查已经完成。核对时长、构图和声音,把提示词、输入图片、参数以及任务标识一并保留。
7. 根据具体问题,只改一个重点
| 遇到的问题 | 下一次优先改什么 |
|---|---|
| 商品变形或漂移 | 减少运动,换更清晰、干扰更少的首帧图 |
| 镜头移动太远 | 把镜头句改成轻微推进,或固定机位 |
| 首尾帧衔接生硬 | 缩小构图差异,让两张图光线更一致 |
| 标签或标志改变 | 降低运动幅度,必要时后期叠加准确图形 |
| 声音不符合预期 | 简化声音指令,或在剪辑时替换音轨 |
| 任务一直等待 | 先检查已有任务状态,再决定是否重新提交 |
| 视频下载失败 | 先重试已完成结果的下载,不要马上付费重生成 |
保留每一轮结果,对照同一个缺陷看是否改善。一次同时更换照片、动作、镜头和时长,即使下一条更好,也很难知道究竟是哪一项起了作用。
下一步:比较模型,或完成站内照片动画
如果还在选模型,继续看 H3 Max 与 Kling 对比;如果关心从提交到可用结果究竟要等多久,可以看 AI 视频生成速度指南。
准备好镜头构想后,先到 H3 Max 模型页查看参数和真实样例。若页面提示生成暂不可用,可以在图生视频工具选择当前可用模型;每次提交前检查参数与积分预估。
常见问题
在哪里可以使用 H3 Max?
FreyaVideo 已有 H3 Max 模型页,可查看参数与实测样例。能否生成以页面当前显示的可用状态为准;生成前请核对所选模型和积分预估。本文的分步操作使用 fal,其账户和费用与 FreyaVideo 分开。
第一次应该用什么参数?
建议从 5 秒、768P 分辨率和 balanced 提示词扩写开始。只保留一个主体和一种镜头运动,方便判断下一次需要修改什么。
首帧和尾帧图片分别有什么作用?
在图生视频接口中,image_url 提供首帧并决定输出宽高比,可选的 end_image_url 用来引导最后一帧。这些控制并不保证商品的每个细节都保持完全一致。
H3 Max 可以原生生成 1080p 或 2K 吗?
本文核对的 H3 Max 接口提供原生 480P 和 768P,时长范围为 5 至 15 秒。标准版 MiniMax H3 是另一款模型,不能直接套用它的参数。
