Skip to main content

使用流程

快速复刻功能实现具体操作流程如下:
  1. 上传待克隆音频 调用 上传复刻音频 上传待克隆的音频文件并获取 file_id
  • 支持上传的文件需遵从以下规范: 上传的音频文件格式需为:mp3、m4a、wav 格式; 上传的音频文件的时长最少应不低于 10 秒,最长应不超过 5 分钟; 上传的音频文件大小需不超过 20mb。
  1. 上传示例音频 (可选) 若需要提供示例音频以增强克隆效果,需要调用 上传示例音频上传示例音频文件并获得对应的 file_id。填写在clone_prompt中的prompt_audio中。
  • 支持上传的文件需遵从以下规范: 上传的音频文件格式需为:mp3、m4a、wav 格式; 上传的音频文件的时长小于 8s; 上传的音频文件大小需不超过 20mb。
  1. 调用复刻接口 基于获取的 file_id 和自定义的 voice_id 作为输入参数,调用 快速复刻接口 克隆音色。
  2. 使用克隆音色 使用复刻生成的 voice_id,根据实际需求调用语音生成接口,例如:

过程示例

1. 上传复刻音频

2. 上传参考音频

3. 进行音色克隆

完整示例

结果示例

  • 复刻音频
  • 示例音频
  • 结果音频

推荐阅读

快速复刻接口

使用 API 接口进行音色快速复刻。

同步语音合成指南

同步语音合成支持基于文本到语音的同步生成,单次可处理最长 10,000 字符的文本。

产品定价

各模型的定价说明、计费方式及使用限制。

速率限制

为保证资源的高效使用,引入速率限制,以确保服务的可用性、稳定性。