镜头与运动
让镜头按你的描述移动
无论跟拍、横移、推进还是高速追随,镜头与主体运动都能紧扣你写下的画面设计。
在 Aniv 使用 MiniMax H3 Max,将文字、首帧图片或参考素材生成短剧镜头。支持 5–15 秒视频、480P / 768P / 1080P 分辨率,并自带原生音频。
文字、首尾帧、参考素材与声音,一站式生成视频
H3 是 MiniMax 的视频模型。H3 Max 是在其基础上完成后训练的变体,针对提示词还原度、音画质量与画面质感做了调优。它会让画面与同步音频在同一次生成中完成;同分辨率下也更贴合你写的镜头描述,所以本站默认使用它。
精准控制镜头、保持视觉一致,并在一次生成中完成画面、动作与声音。
镜头与运动
无论跟拍、横移、推进还是高速追随,镜头与主体运动都能紧扣你写下的画面设计。
首帧与尾帧
从起始图片出发,还可指定结束画面,H3 Max 会在两个时刻之间生成连贯自然的运动。
角色一致性
当场景、光线与机位变化时,人物的面部、服装、比例和身份特征仍可保持连贯。
原生音频
环境声、音效、对白和音乐可与视频同批生成,并与屏幕中的动作保持同步。
艺术指导
选定的色彩、质感、线条或电影化处理,可以贯穿序列中的每一个画面。
提示词遵循
逐步描述动作与场景,H3 Max 可按顺序执行,并保留指定的视觉细节与适用的画面文字。
H3 Max 专为高速创作而生,5 秒 768P 视频的模型推理约 3 秒即可完成,让你的灵感在几秒内变成带声音的动态画面。排队和文件处理可能需要额外时间。
时长、分辨率、画面比例、随机种子、尾帧——和模型接受的字段一一对应。
生成前显示准确消耗,可使用订阅积分或按需充值;渲染失败会退回积分。
H3 两种语言都读得懂,写中文或英文都能正常理解。
H3 Max 更侧重提示词还原度、音画质量、画面质感和快速迭代;标准 H3 则把输出上限提高到 2K 和 4K。Aniv 目前只接入了 H3 Max。
| 模型 | H3 Max本站默认 | H3 |
|---|---|---|
| 更适合 | 提示词还原与快速迭代 | 2K 和 4K 高分辨率交付 |
| 最高输出 | 1080P | 4K |
| 输入方式 | 文字或图片,可选尾帧 | 文字或图片,可选尾帧 |
| 同步音频 | 支持 | 支持 |
还有其他问题?请联系 support@aniv.ai