Skip to main content

获取 API Key


语言模型

语言模型接口使用 MiniMax M3MiniMax M2.7MiniMax M2.7-highspeedMiniMax M2.5MiniMax M2.5-highspeedMiniMax M2.1MiniMax M2.1-highspeedMiniMax M2 根据输入的上下文,让模型生成对话内容、工具调用。 可通过 HTTP 请求、Anthropic SDK(推荐) 或 OpenAI SDK 接入。 支持模型 如果在使用模型过程中遇到任何问题:
  • 通过邮箱 Model@minimaxi.com 等官方渠道联系我们的技术支持团队
  • 在我们的 Github 仓库提交Issue

Anthropic API 兼容(推荐)

通过 Anthropic SDK 调用 MiniMax 模型

OpenAI API 兼容

通过 OpenAI SDK 调用 MiniMax 模型

视频模型

本接口基于 MiniMax-H3 模型,支持文本、图片、视频、音频等多模态输入进行视频生成,覆盖文生视频、图生视频、首尾帧生成视频、多模态参考生视频等场景。 支持模型 接口说明 MiniMax-H3 任务采用异步方式,提供创建视频生成任务创建 H3-Context-IR 任务创建视频再生成任务三个创建入口,并共用查询、列表以及取消或删除接口。使用步骤如下:
  1. 根据场景创建视频生成任务,使用相同的多模态输入创建 H3-Context-IR 任务,或对符合 MiniMax-H3 768P 输出规格的源视频创建视频再生成任务;再生成请求必须且只能包含一个 role=base_video 的源视频项。成功后均返回 task_id
  2. 使用查询任务接口按 task_id 获取状态与结果;视频任务成功后从 content.url 获取成片地址,H3-Context-IR 任务成功后从 content.prompt 获取增强提示词。也可以使用查询任务列表接口批量查看,并通过 task_type 区分 generationh3_context_irregeneration
  3. 对排队中的任务,可使用取消或删除任务接口取消;对成功或失败的任务,可使用同一接口删除任务记录。

创建视频生成任务

基于多模态 content 输入创建视频生成任务

创建 H3-Context-IR 任务

深度理解视频生成的多模态上下文并生成结构化增强提示词

创建视频再生成任务

将符合 MiniMax-H3 768P 输出规格的视频再生成为 2K 视频

查询任务

按 task_id 查询任务状态并获取成片下载地址

查询任务列表

分页查询最近 7 天内的任务并按任务类型过滤

取消或删除任务

取消排队中的任务,或删除成功和失败的任务记录

语音模型

语音模型提供语音合成音色复刻音色设计能力,支持 40 种语言、300+ 系统音色,可按需选择同步或异步方式生成。 接口均为无状态设计:单次调用仅处理传入内容,不存储用户数据,不涉及业务逻辑状态。 支持模型 接口说明 四类能力共用上述模型:
  1. 同步语音合成:文本实时转语音,单次最长 10,000 字符;支持 300+ 系统音色与复刻音色、音量/语调/语速调整、按比例混音、流式输出,输出格式含 mp3、pcm、flac、wav。提供 HTTPWebSocket 两种接入方式。
  2. 异步长文本语音合成:单次最长 100 万字符,适合整本书籍等长文本;支持句级时间戳(字幕)。创建任务得到 task_id,查询成功后用返回的 file_id 经文件接口下载(下载 URL 自返回起 9 小时内有效)。
  3. 音色快速复刻:上传待复刻音频获取 file_id(可选再上传示例音频增强效果),再调用快速复刻生成自定义 voice_id。需先完成个人或企业认证。
  4. 音色设计:基于声音描述 prompt 生成个性化音色,产出的 voice_id 可直接用于上述合成接口。
音色复刻与音色设计产出的均为临时音色:费用在首次用于语音合成时才收取(不含接口内试听);若 **168 小时(7 天)**内未在任意语音合成接口中使用,该音色将被删除。

HTTP 同步语音合成

通过 HTTP 请求进行语音合成

WebSocket 同步语音合成

通过 WebSocket 进行流式语音合成

创建异步语音任务

创建长文本语音生成任务

查询异步任务状态

查询语音生成任务状态

上传复刻音频

上传待克隆的音频文件

快速复刻

执行音色克隆

音色设计

基于描述生成个性化音色

图片生成

本接口支持基于用户提供的文本或参考图片,进行创意图像生成。支持设置不同图片比例和长宽像素设置,满足不同场景下图像需求。 接口说明 通过创建图片生成任务接口,使用文本描述和参考图片,进行图像生成。 模型列表

文生图

基于文本描述生成图像

图生图

基于参考图片生成图像

音乐生成

自 2026 年 8 月 20 日起,付费接口(音乐生成、歌词生成)不再面向新用户提供服务,历史付费用户可继续使用现有 API 服务;免费音乐生成接口(Music-3.0-free、Music-2.6-free、music-cover-free)停止服务。如需体验或使用音乐生成能力,可前往 MiniMax Audio,或使用已发布在 Hugging Face魔搭 ModelScope 的 MiniMax Music 3 开源模型。
本接口根据歌曲描述(prompt)和歌词(lyrics),生成一首人声的歌曲。 支持模型

音乐生成接口

根据描述和歌词生成音乐

文件管理

本接口是作为文件管理接口,配合 MiniMax 开放平台的其他接口使用。 接口说明 本接口是作为文件管理接口,配合其他接口使用。共包含 5 个接口:上传列出检索下载删除 文件的支持格式、容量及大小限制以上传文件接口文档为准,详见 上传文件

上传文件

上传文件到平台

文件列表

获取已上传的文件列表

工具

Web Search web_search 是由 MiniMax 在服务端托管和执行的联网搜索工具。模型可在生成回复时自动检索实时信息,并基于搜索结果作答;支持通过 Anthropic Messages API 和 OpenAI Responses API 调用。接口说明与示例详见 Web Search 官方 MCP MiniMax 提供官方的 Python 版本JavaScript 版本 模型上下文协议(MCP)服务器实现代码,支持语音合成、音色克隆、视频生成、音乐生成等功能,详细说明请参考 MiniMax MCP 使用指南 语音调试台

语音合成调试台

音色快速复刻调试台