MiniMax H3 Max AI 视频生成器

在 Aniv 使用 MiniMax H3 Max,将文字、首帧图片或参考素材生成短剧镜头。支持 5–15 秒视频、480P / 768P / 1080P 分辨率,并自带原生音频。

文字、首尾帧、参考素材与声音,一站式生成视频

描述您想要生成的视频画面...
已包含原生音频

MiniMax H3 Max 是什么?

H3 是 MiniMax 的视频模型。H3 Max 是在其基础上完成后训练的变体,针对提示词还原度、音画质量与画面质感做了调优。它会让画面与同步音频在同一次生成中完成;同分辨率下也更贴合你写的镜头描述,所以本站默认使用它。

H3 Max 规格

时长
5 到 15 秒
分辨率
480P、768P 或 1080P
输入方式
文字提示词、图片(可选尾帧),或最多 12 个参考图片 / 视频 / 音频
画面比例
21:9、16:9、4:3、1:1、3:4、9:16

用 H3 Max 可以创作什么

精准控制镜头、保持视觉一致,并在一次生成中完成画面、动作与声音。

镜头与运动

让镜头按你的描述移动

无论跟拍、横移、推进还是高速追随,镜头与主体运动都能紧扣你写下的画面设计。

首帧与尾帧

让两个画面连成一段旅程

从起始图片出发,还可指定结束画面,H3 Max 会在两个时刻之间生成连贯自然的运动。

角色一致性

跨镜头保持角色清晰可辨

当场景、光线与机位变化时,人物的面部、服装、比例和身份特征仍可保持连贯。

原生音频

画面与声音同步生成

环境声、音效、对白和音乐可与视频同批生成,并与屏幕中的动作保持同步。

艺术指导

让整段视频保持统一视觉语言

选定的色彩、质感、线条或电影化处理,可以贯穿序列中的每一个画面。

提示词遵循

按你写下的顺序呈现情节

逐步描述动作与场景,H3 Max 可按顺序执行,并保留指定的视觉细节与适用的画面文字。

AI 视频领域的新奇点

H3 Max 专为高速创作而生,5 秒 768P 视频的模型推理约 3 秒即可完成,让你的灵感在几秒内变成带声音的动态画面。排队和文件处理可能需要额外时间。

核心参数清楚可调

时长、分辨率、画面比例、随机种子、尾帧——和模型接受的字段一一对应。

每次生成透明扣积分

生成前显示准确消耗,可使用订阅积分或按需充值;渲染失败会退回积分。

中英文提示词都可以

H3 两种语言都读得懂,写中文或英文都能正常理解。

H3 Max 还是 H3?

H3 Max 更侧重提示词还原度、音画质量、画面质感和快速迭代;标准 H3 则把输出上限提高到 2K 和 4K。Aniv 目前只接入了 H3 Max。

H3 Max 还是 H3?
模型
H3 Max本站默认
H3
更适合提示词还原与快速迭代2K 和 4K 高分辨率交付
最高输出1080P4K
输入方式文字或图片,可选尾帧文字或图片,可选尾帧
同步音频支持支持

常见问题

常见问题

还有其他问题?请联系 support@aniv.ai

H3 Max 是 fal 基于 MiniMax H3 后训练的版本,重点优化提示词遵循和画面美感。

480P 每秒 8 积分,768P 每秒 12 积分,1080P 每秒 32 积分;参考模式按两倍计费。5 秒 768P 视频消耗 60 积分,已包含原生音频。

开始使用

现在就用 H3 Max 生成你的视频

一段文字,或一张首帧图片——5 到 15 秒、自带同步音频的成片,一次生成完成。