鏡頭與運動
讓鏡頭按你的描述移動
無論跟拍、橫移、推進還是高速追隨,鏡頭與主體運動都能緊扣你寫下的畫面設計。
在 Aniv 使用 MiniMax H3 Max,將文字、首幀圖片或參考素材生成短劇鏡頭。支援 5–15 秒影片、480P / 768P / 1080P 解析度,並自帶原生音訊。
文字、首尾幀、參考素材與聲音,一站式生成影片
H3 是 MiniMax 的影片模型。H3 Max 是在其基礎上完成後訓練的變體,針對提示詞還原度、音畫質量與畫面質感做了調優。它會讓畫面與同步音訊在同一次生成中完成;同分辨率下也更貼合你寫的鏡頭描述,所以本站預設使用它。
精準控制鏡頭、保持視覺一致,並在一次生成中完成畫面、動作與聲音。
鏡頭與運動
無論跟拍、橫移、推進還是高速追隨,鏡頭與主體運動都能緊扣你寫下的畫面設計。
首幀與尾幀
從起始圖片出發,還可指定結束畫面,H3 Max 會在兩個時刻之間生成連貫自然的運動。
角色一致性
當場景、光線與機位變化時,人物的面部、服裝、比例和身份特徵仍可保持連貫。
原生音訊
環境聲、音效、對白和音樂可與影片同批生成,並與螢幕中的動作保持同步。
藝術指導
選定的色彩、質感、線條或電影化處理,可以貫穿序列中的每一個畫面。
提示詞遵循
逐步描述動作與場景,H3 Max 可按順序執行,並保留指定的視覺細節與適用的畫面文字。
H3 Max 專為高速創作而生,5 秒 768P 影片的模型推理約 3 秒即可完成,讓你的靈感在幾秒內變成帶聲音的動態畫面。排隊和檔案處理可能需要額外時間。
時長、解析度、畫面比例、隨機種子、尾幀——和模型接受的欄位一一對應。
生成前顯示準確消耗,可使用訂閱積分或按需充值;渲染失敗會退回積分。
H3 兩種語言都讀得懂,寫中文或英文都能正常理解。
H3 Max 更側重提示詞還原度、音畫質量、畫面質感和快速迭代;標準 H3 則把輸出上限提高到 2K 和 4K。Aniv 目前只接入了 H3 Max。
| 模型 | H3 Max本站預設 | H3 |
|---|---|---|
| 更適合 | 提示詞還原與快速迭代 | 2K 和 4K 高解析度交付 |
| 最高輸出 | 1080P | 4K |
| 輸入方式 | 文字或圖片,可選尾幀 | 文字或圖片,可選尾幀 |
| 同步音訊 | 支援 | 支援 |
MiniMax H3 Max 生成的是單個片段。想把一個故事做成完整劇集——劇本、一致的角色、分鏡、配音和影片——請使用 Aniv 的 AI 短劇生成器。
還有其他問題?請聯絡 support@aniv.ai