Skip to main content
MiniMax H3 是开放通用的多模态视频模型,可以统一理解文本、图片、视频和音频输入,完成视频生成、参考创作与视频编辑。

支持的生成方式

模型规格与输入条件

输出规格

输入条件

工作流程

视频生成是一个异步过程,包含以下三个步骤:
  1. 创建生成任务:提交一个视频生成请求,获得任务 ID (task_id)
  2. 查询任务状态:使用 task_id 轮询任务状态。任务成功后,会返回一个文件 ID (file_id)
  3. 获取视频文件:使用 file_id 获取视频的下载地址并保存文件

功能与代码示例

为了简化代码,我们将轮询和下载的逻辑封装为公共函数,并举例了四种模式下如何创建任务。

生成视频结果

文生视频

只提供一段文字描述,模型即可根据描述生成视频。为了对视频内容进行更精细的控制,可在关键描述后添加 [运镜] 指令,来引导镜头调度。 示例生成结果

首帧/尾帧生成视频

提供首帧图片、尾帧图片,或同时提供两张,再结合文字描述生成视频。视频的起始或结束画面完全可控,适合让静态图片”动起来”或补完自然的过渡画面。 示例生成结果

全能参考生成

提供参考图片、参考视频或参考音频(可组合使用),并结合文字描述生成视频,在生成过程中保持参考主体或素材的特征一致性。 示例生成结果

推荐阅读

创建视频生成任务

使用本接口通过多模态 content 输入,创建 MiniMax-H3 视频生成任务。

查询视频生成任务

使用本接口按 task_id 查询任务状态并获取成片下载地址。

产品定价

各模型的定价说明、计费方式及使用限制。