获取 API Key
-
按量付费:通过 接口密钥 > 创建新的 API Key,获取 API Key
按量付费支持使用所有模态模型,包括语言、视频、语音、图像等
-
Token Plan:通过 订阅管理 > Token Plan,查看 订阅 Key
订阅 Key 用于 Token Plan 订阅套餐和已购积分,并与按量计费 API Key 相互独立。详情见 Token Plan 概要
语言模型
语言模型接口使用 MiniMax M3,MiniMax M2.7,MiniMax M2.7-highspeed,MiniMax M2.5,MiniMax M2.5-highspeed,MiniMax M2.1,MiniMax M2.1-highspeed,MiniMax M2 根据输入的上下文,让模型生成对话内容、工具调用。 可通过 HTTP 请求、Anthropic SDK(推荐) 或 OpenAI SDK 接入。 支持模型
如果在使用模型过程中遇到任何问题:
- 通过邮箱 Model@minimaxi.com 等官方渠道联系我们的技术支持团队
- 在我们的 Github 仓库提交Issue
Anthropic API 兼容(推荐)
通过 Anthropic SDK 调用 MiniMax 模型
OpenAI API 兼容
通过 OpenAI SDK 调用 MiniMax 模型
视频模型
本接口基于 MiniMax-H3 模型,支持文本、图片、视频、音频等多模态输入进行视频生成,覆盖文生视频、图生视频、首尾帧生成视频、多模态参考生视频等场景。 支持模型
接口说明
MiniMax-H3 任务采用异步方式,提供创建视频生成任务、创建 H3-Context-IR 任务和创建视频再生成任务三个创建入口,并共用查询、列表以及取消或删除接口。使用步骤如下:
- 根据场景创建视频生成任务,使用相同的多模态输入创建 H3-Context-IR 任务,或对符合 MiniMax-H3 768P 输出规格的源视频创建视频再生成任务;再生成请求必须且只能包含一个
role=base_video的源视频项。成功后均返回task_id。 - 使用查询任务接口按
task_id获取状态与结果;视频任务成功后从content.url获取成片地址,H3-Context-IR 任务成功后从content.prompt获取增强提示词。也可以使用查询任务列表接口批量查看,并通过task_type区分generation、h3_context_ir与regeneration。 - 对排队中的任务,可使用取消或删除任务接口取消;对成功或失败的任务,可使用同一接口删除任务记录。
创建视频生成任务
基于多模态 content 输入创建视频生成任务
创建 H3-Context-IR 任务
深度理解视频生成的多模态上下文并生成结构化增强提示词
创建视频再生成任务
将符合 MiniMax-H3 768P 输出规格的视频再生成为 2K 视频
查询任务
按 task_id 查询任务状态并获取成片下载地址
查询任务列表
分页查询最近 7 天内的任务并按任务类型过滤
取消或删除任务
取消排队中的任务,或删除成功和失败的任务记录
语音模型
语音模型提供语音合成、音色复刻与音色设计能力,支持 40 种语言、300+ 系统音色,可按需选择同步或异步方式生成。 接口均为无状态设计:单次调用仅处理传入内容,不存储用户数据,不涉及业务逻辑状态。 支持模型
接口说明
四类能力共用上述模型:
- 同步语音合成:文本实时转语音,单次最长 10,000 字符;支持 300+ 系统音色与复刻音色、音量/语调/语速调整、按比例混音、流式输出,输出格式含 mp3、pcm、flac、wav。提供 HTTP 与 WebSocket 两种接入方式。
- 异步长文本语音合成:单次最长 100 万字符,适合整本书籍等长文本;支持句级时间戳(字幕)。创建任务得到
task_id,查询成功后用返回的file_id经文件接口下载(下载 URL 自返回起 9 小时内有效)。 - 音色快速复刻:上传待复刻音频获取
file_id(可选再上传示例音频增强效果),再调用快速复刻生成自定义voice_id。需先完成个人或企业认证。 - 音色设计:基于声音描述 prompt 生成个性化音色,产出的
voice_id可直接用于上述合成接口。
音色复刻与音色设计产出的均为临时音色:费用在首次用于语音合成时才收取(不含接口内试听);若 **168 小时(7 天)**内未在任意语音合成接口中使用,该音色将被删除。
支持的 40 种语言
支持的 40 种语言
HTTP 同步语音合成
通过 HTTP 请求进行语音合成
WebSocket 同步语音合成
通过 WebSocket 进行流式语音合成
创建异步语音任务
创建长文本语音生成任务
查询异步任务状态
查询语音生成任务状态
上传复刻音频
上传待克隆的音频文件
快速复刻
执行音色克隆
音色设计
基于描述生成个性化音色
图片生成
本接口支持基于用户提供的文本或参考图片,进行创意图像生成。支持设置不同图片比例和长宽像素设置,满足不同场景下图像需求。 接口说明 通过创建图片生成任务接口,使用文本描述和参考图片,进行图像生成。 模型列表文生图
基于文本描述生成图像
图生图
基于参考图片生成图像
音乐生成
自 2026 年 8 月 20 日起,付费接口(音乐生成、歌词生成)不再面向新用户提供服务,历史付费用户可继续使用现有 API 服务;免费音乐生成接口(Music-3.0-free、Music-2.6-free、music-cover-free)停止服务。如需体验或使用音乐生成能力,可前往 MiniMax Audio,或使用已发布在 Hugging Face 和 魔搭 ModelScope 的 MiniMax Music 3 开源模型。
音乐生成接口
根据描述和歌词生成音乐
文件管理
本接口是作为文件管理接口,配合 MiniMax 开放平台的其他接口使用。 接口说明 本接口是作为文件管理接口,配合其他接口使用。共包含 5 个接口:上传、列出、检索、下载、删除。 文件的支持格式、容量及大小限制以上传文件接口文档为准,详见 上传文件。上传文件
上传文件到平台
文件列表
获取已上传的文件列表
工具
Web Searchweb_search 是由 MiniMax 在服务端托管和执行的联网搜索工具。模型可在生成回复时自动检索实时信息,并基于搜索结果作答;支持通过 Anthropic Messages API 和 OpenAI Responses API 调用。接口说明与示例详见 Web Search。
官方 MCP
MiniMax 提供官方的 Python 版本 和 JavaScript 版本 模型上下文协议(MCP)服务器实现代码,支持语音合成、音色克隆、视频生成、音乐生成等功能,详细说明请参考 MiniMax MCP 使用指南
语音调试台