Skip to main content
MiniMax H3 是开放通用的多模态视频模型,可以统一理解文本、图片、视频和音频输入,完成视频生成、参考创作与视频编辑。

支持的生成方式

模型规格与输入条件

输出规格

输入条件

工作流程

视频生成是一个异步过程,包含以下三个步骤:
  1. 创建生成任务:提交一个视频生成请求,获得任务 ID (task_id)
  2. 查询任务状态:使用 task_id 轮询任务状态。任务成功后,直接返回成片下载地址 (content.url)
  3. 获取视频文件:下载 content.url 指向的视频并保存到本地

功能与代码示例

为了简化代码,我们将轮询和下载的逻辑封装为公共函数,并举例了四种模式下如何创建任务。

生成视频结果

文生视频

只提供一段文字描述,模型即可根据描述生成视频。为了对视频内容进行更精细的控制,可在关键描述后添加 [运镜] 指令,来引导镜头调度。 示例生成结果

首帧/尾帧生成视频

提供首帧图片、尾帧图片,或同时提供两张,再结合文字描述生成视频。视频的起始或结束画面完全可控,适合让静态图片”动起来”或补完自然的过渡画面。 示例生成结果

全能参考生成

提供参考图片、参考视频或参考音频(可组合使用),并结合文字描述生成视频,在生成过程中保持参考主体或素材的特征一致性。 示例生成结果

创建 H3-Context-IR 任务

如需在生成视频前获得更完整的提示词,可以创建 H3-Context-IR 任务。H3-Context-IR 会深度理解文本、图像、音频和视频等多模态上下文及其相互关系,通过复杂逻辑推理生成结构化表达,并在尽量保持用户原始意图的前提下丰富语义细节。本接口只返回增强提示词,不创建视频。 H3-Context-IR 采用异步任务形式。创建成功后,使用查询任务查询任务列表获取结果;任务成功后从 content.prompt 获取增强提示词,并可通过 task_type=h3_context_ir 识别该任务。

视频再生成

如果已有符合 MiniMax-H3 768P 输出规格的成片,可以调用创建视频再生成任务接口输出 2K 视频。请求时需原样提交生成 768P 视频时使用的全部 content,并额外加入且仅加入一个 type=video_urlrole=base_video 的源视频项。 再生成任务与其他 H3 任务共用查询任务查询任务列表以及取消或删除任务接口;可通过 task_type=regeneration 识别。

推荐阅读

创建视频生成任务

使用本接口通过多模态 content 输入,创建 MiniMax-H3 视频生成任务。

创建 H3-Context-IR 任务

深度理解视频生成的多模态上下文,并生成结构化增强提示词。

创建视频再生成任务

对符合 MiniMax-H3 768P 输出规格的源视频进行再生成,输出 2K 视频。

查询任务

使用本接口按 task_id 查询任务状态并获取成片下载地址。

查询任务列表

分页查询最近 7 天内的任务,并按 task_type 区分任务类型。

取消或删除任务

取消排队中的任务,或删除成功和失败的任务记录。

产品定价

各模型的定价说明、计费方式及使用限制。