音视频同步
在一个场景中统一规划画面、动作、对白与声音
MiniMax H3 官方资料描述的是联合音视频生成,而不是把声音作为后期步骤。清晰的提示词可以在同一时间线上协调可见动作、镜头运动、对白、物理声音、环境声和配乐。
在同一个工作区了解 MiniMax H3 音视频工作流、学习提示词结构,并把你的视频创意整理成可执行的制作简报。
设置图片或视频,并在当前页面直接查看生成结果。
打开任一视频查看完整提示词,并可一键填入 MiniMax H3 生成器。
16:9 · 10s · 720p
MiniMax H3
描述场景或添加图片,选择可用的视频设置,并按照 MiniMax H3 工作流生成和逐步优化结果。
提示词素材墙
鼠标悬停即可预览动态效果。打开任一卡片可查看完整提示词、视频设置,并一键填入上方生成器。
这些示例展示 MiniMax H3 在镜头运动、主体连续性、产品展示、对白和声音场景中的提示词结构。
模型概览
MiniMax H3 是通用多模态生成系统,可联合理解文本、图片、视频和音频,并生成带同步立体声的视频。官方资料介绍了首帧、尾帧、首尾帧和完整参考素材工作流,以及用于生成更高分辨率 2K 成果的再生成流程。
4–15 秒
官方输出时长范围
24 FPS
官方输出帧率
32 kHz
原生立体声音频
最高 2K
通过 H3 Regenerate-2K
音视频同步
MiniMax H3 官方资料描述的是联合音视频生成,而不是把声音作为后期步骤。清晰的提示词可以在同一时间线上协调可见动作、镜头运动、对白、物理声音、环境声和配乐。
灵活参考控制
H3 Base FL2VA 支持文生视频及可选的首帧和尾帧锚点;H3 Base Ref2VA 进一步支持参考图片、视频片段和音频,既适合快速构思,也适合控制更明确的制作任务。
上下文感知 2K 工作流
官方 H3 工作流包含 768p 基础结果和独立的 H3 Regenerate-2K 阶段,并将结果与原始多模态上下文结合。目标是从源指令恢复小细节,而不是在生成后凭空猜测。
使用流程
按照清晰的 MiniMax H3 提示词流程,从起始画面和镜头指导进入生成、检查与逐步优化。
为 MiniMax H3 输入文字描述或上传一张图片。先说明主体、环境、构图和初始状态,再补充动作。
按顺序写清事件,明确镜头运动,并说明哪些元素必须保持一致。需要快速开始时,可以借用素材墙提示词的结构。
使用 MiniMax H3 生成,然后在历史记录中查看结果。每次只调整一个变量,例如动作强度、时长或构图。
应用场景
把产品简报转化为可控的主视觉镜头、发布短片或活动变体。
使用指定画面作为稳定视觉锚点,再定义可信的动作和结尾。
在正式制作前规划镜头运动、角色动作、场景节奏和声音意图。
把对白、环境声、物理音效和音乐写成同一时间线上的协同层。
把角色、地点、动作来源和声音方向组合为更明确的创意简报。
规划简洁的 9:16 场景,保持单一清晰动作、主体连续性和明确结尾。
模型对比
以 MiniMax H3 官方工作流作为能力指南,再在 ImageMake 工作区中组织提示词和可用设置。
| 模型对比 | MiniMax H3 能力 | ImageMake MiniMax H3 工作区 |
|---|---|---|
| 本页可用性 | 已设为页面默认模型 | 支持从文本和图片开始创作 |
| 输入方式 | 官方版本包含文本、首尾帧以及图片、视频和音频多模态参考 | 文本提示词,可选上传一张图片 |
| 时长与输出 | 官方资料列出 4–15 秒、24 FPS,并提供独立 Regenerate-2K 工作流 | 从页面提供的时长和分辨率设置开始 |
| 音频 | 官方工作流描述同步的 32 kHz 立体声音频 | 在提示词中描述对白、环境声、音效和音乐 |
ImageMake 定价
下方方案提供 ImageMake 积分,用于在 MiniMax H3 工作区中创作、检查和逐步优化视频。
非常适合初次使用 ImageMake 的用户
图片创作者最爱
给使用 ImageMake 制作图片的资深用户
常见问题
可以。MiniMax H3 是本页的默认模型,你可以在同一工作区准备提示词、选择可用设置并开始视频创作。
MiniMax H3 是多模态音视频生成模型。官方资料描述它可以联合理解文本、图片、视频和音频,并生成带同步立体声的视频。
根据官方模型资料,可以。资料列出了原生 32 kHz 立体声音频,并说明提示词可以协调对白、物理声音、环境声和音乐。
MiniMax H3 官方模型卡列出的输出时长为 4 到 15 秒,帧率为 24 FPS。
支持。官方 FL2VA 工作流支持可选首帧和尾帧锚点,包括首帧、尾帧以及首尾帧生成。
它是 MiniMax H3 官方描述的高分辨率阶段,会把基础结果和原始上下文再次送入 H3,生成包含上下文细节的 2K 输出。
它们展示 MiniMax H3 在动作、镜头指导、主体连续性、产品呈现、对白和声音场景中的提示词写法。
提示词和兼容设置会填入 MiniMax H3 生成器,但不会自动开始生成。你可以先检查和编辑表单,再决定何时生成。