影音同步
在一個場景中統一規劃畫面、動作、對白與聲音
MiniMax H3 官方資料描述的是聯合影音生成,而不是把聲音當成後製步驟。清楚的提示詞可以在同一時間軸上協調可見動作、鏡頭運動、對白、物理聲音、環境聲和配樂。
在同一個工作區瞭解 MiniMax H3 影音工作流程、學習提示詞結構,並把你的影片創意整理成可執行的製作簡報。
設定圖片或影片,並在目前頁面直接查看生成結果。
開啟任一影片查看完整提示詞,並可一鍵填入 MiniMax H3 生成器。
16:9 · 10s · 720p
MiniMax H3
描述場景或加入圖片,選擇可用的影片設定,並按照 MiniMax H3 工作流程生成和逐步最佳化結果。
提示詞素材牆
滑鼠停留即可預覽動態效果。開啟任一卡片可查看完整提示詞、影片設定,並一鍵填入上方生成器。
這些範例展示 MiniMax H3 在鏡頭運動、主體連續性、產品展示、對白和聲音場景中的提示詞結構。
模型概覽
MiniMax H3 是通用多模態生成系統,可共同理解文字、圖片、影片和音訊,並生成帶同步立體聲的影片。官方資料介紹了首幀、尾幀、首尾幀和完整參考素材工作流程,以及用於生成更高解析度 2K 成果的再生成流程。
4–15 秒
官方輸出時長範圍
24 FPS
官方輸出影格率
32 kHz
原生立體聲音訊
最高 2K
透過 H3 Regenerate-2K
影音同步
MiniMax H3 官方資料描述的是聯合影音生成,而不是把聲音當成後製步驟。清楚的提示詞可以在同一時間軸上協調可見動作、鏡頭運動、對白、物理聲音、環境聲和配樂。
靈活參考控制
H3 Base FL2VA 支援文生影片及可選的首幀和尾幀錨點;H3 Base Ref2VA 進一步支援參考圖片、影片片段和音訊,既適合快速構思,也適合控制更明確的製作任務。
上下文感知 2K 工作流程
官方 H3 工作流程包含 768p 基礎結果和獨立的 H3 Regenerate-2K 階段,並將結果與原始多模態上下文結合。目標是從來源指令恢復小細節,而不是在生成後憑空猜測。
使用流程
按照清晰的 MiniMax H3 提示詞流程,從起始畫面和鏡頭指導進入生成、檢查與逐步最佳化。
為 MiniMax H3 輸入文字描述或上傳一張圖片。先說明主體、環境、構圖和初始狀態,再補充動作。
依序寫清楚事件,明確指定鏡頭運動,並說明哪些元素必須保持一致。需要快速開始時,可以參考素材牆提示詞的結構。
使用 MiniMax H3 生成,然後在歷史記錄中查看結果。每次只調整一個變數,例如動作強度、時長或構圖。
應用場景
把產品簡報轉化為可控的主視覺鏡頭、發布短片或活動變體。
使用指定畫面作為穩定視覺錨點,再定義可信的動作和結尾。
在正式製作前規劃鏡頭運動、角色動作、場景節奏和聲音意圖。
把對白、環境聲、物理音效和音樂寫成同一時間軸上的協同層。
把角色、地點、動作來源和聲音方向組合成更明確的創意簡報。
規劃簡潔的 9:16 場景,保持單一清楚動作、主體連續性和明確結尾。
模型比較
以 MiniMax H3 官方工作流程作為能力指南,再在 ImageMake 工作區中組織提示詞和可用設定。
| 模型比較 | MiniMax H3 能力 | ImageMake MiniMax H3 工作區 |
|---|---|---|
| 本頁可用性 | 已設為頁面預設模型 | 支援從文字和圖片開始創作 |
| 輸入方式 | 官方版本包含文字、首尾幀以及圖片、影片和音訊多模態參考 | 文字提示詞,可選上傳一張圖片 |
| 時長與輸出 | 官方資料列出 4–15 秒、24 FPS,並提供獨立 Regenerate-2K 工作流程 | 從頁面提供的時長和解析度設定開始 |
| 音訊 | 官方工作流程描述同步的 32 kHz 立體聲音訊 | 在提示詞中描述對白、環境聲、音效和音樂 |
ImageMake 定價
下方方案提供 ImageMake 點數,用於在 MiniMax H3 工作區中創作、檢查和逐步最佳化影片。
非常適合初次使用 ImageMake 的用戶
圖片創作者最愛
給使用 ImageMake 製作圖片的資深用戶
常見問題
可以。MiniMax H3 是本頁的預設模型,你可以在同一工作區準備提示詞、選擇可用設定並開始影片創作。
MiniMax H3 是多模態影音生成模型。官方資料描述它可以共同理解文字、圖片、影片和音訊,並生成帶同步立體聲的影片。
根據官方模型資料,可以。資料列出了原生 32 kHz 立體聲音訊,並說明提示詞可以協調對白、物理聲音、環境聲和音樂。
MiniMax H3 官方模型卡列出的輸出時長為 4 到 15 秒,影格率為 24 FPS。
支援。官方 FL2VA 工作流程支援可選首幀和尾幀錨點,包括首幀、尾幀以及首尾幀生成。
它是 MiniMax H3 官方描述的高解析度階段,會把基礎結果和原始上下文再次傳入 H3,生成包含上下文細節的 2K 輸出。
它們展示 MiniMax H3 在動作、鏡頭指導、主體連續性、產品呈現、對白和聲音場景中的提示詞寫法。
提示詞和相容設定會填入 MiniMax H3 生成器,但不會自動開始生成。你可以先檢查和編輯表單,再決定何時生成。