Music 3.0:即刻体验全新音乐生成能力
- 更懂创作意图:语义理解模型升级,减少”AI 味”偏移。
- 音质全面跃升:告别拥挤和浑浊,支持指定乐器与真实技法(滑音、连奏等),一键触达商业唱片级听感。
- 人声合成更自然:新一代人声引擎彻底消除高频”机器嘶嘶声”,可控制旋律、咬字、呼吸与多层和声,逼近真人录音室表现。
音乐生成示例
下面以生成一首 1940 年代大乐队摇摆爵士风格的歌曲为例,演示如何通过两步完成从灵感到成品的全流程:先用歌词生成接口,根据主题自动写词;再用音乐生成接口创作,轻松产出一首完整歌曲。本示例重点展示 Music 3.0 在器乐编配和高采样率乐器表现上的能力。1
调用歌词生成接口,根据主题生成歌词(可选)
只需告诉模型你想要什么主题——比如”欢快的 1940 年代大乐队摇摆爵士”,歌词生成接口就会自动为你写出包含段落结构(Verse、Chorus、Bridge 等)的完整歌词。如果你已经有了歌词,可以跳过这一步。另外即使没有歌词也可以直接进入第二步,调用音乐生成接口,谱曲并生成完整歌曲。
2
调用音乐生成接口,谱曲并生成完整歌曲
拿到歌词后,通过
prompt 设定音乐风格(如 “Big Band Swing, Brass Section, Walking Bass”),将歌词传入 lyrics 参数,音乐生成接口会为你编曲、演唱,输出一首完整的歌曲。如果没有歌词,可将 lyrics_optimizer 参数设置为 true,则可直接生成歌曲。而且 Music 3.0 支持了纯音乐生成,请参考 is_instrumental 参数。3
试听生成结果
完成上述两步后,你将得到一首完整的歌曲!点击播放即可试听效果:
翻唱生成
Music Cover 可以基于已有歌曲生成不同风格的翻唱版本。支持两种模式:- 一步翻唱:直接传入参考音频,系统自动通过 ASR 提取歌词。
- 两步翻唱:先对音频进行前处理,提取并修改歌词后再生成翻唱。
一步翻唱(快捷模式)
将参考音频 URL 和风格描述直接传入音乐生成接口,歌词将从音频中自动提取。两步翻唱(进阶模式 — 支持歌词修改)
如需修改歌词,可使用两步流程:先调用前处理接口提取音频特征和歌词,修改歌词后再生成翻唱。1
步骤 1:预处理参考音频
调用翻唱前处理接口提取音频特征和结构化歌词。此步骤免费(不计费)。返回内容包括:
cover_feature_id:音频特征唯一标识(有效期 24 小时)formatted_lyrics:带段落标签([Verse]、[Chorus]等)的结构化歌词,可自由编辑structure_result:JSON 字符串,包含段落类型和时间戳audio_duration:参考音频时长(秒)
2
步骤 2:修改歌词并生成翻唱
查看并编辑上一步返回的
formatted_lyrics,然后将 cover_feature_id 和修改后的歌词传入音乐生成接口。使用
cover_feature_id 时,不要传入 audio_url 或 audio_base64(三者互斥)。lyrics 参数为必填(10–1000 字符)。推荐阅读
音乐生成接口
使用 API 接口,输入歌词和歌曲描述,进行歌曲生成。
翻唱前处理接口
对参考音频进行预处理,提取特征和歌词,用于两步翻唱生成。
歌词生成接口
使用 API 接口,输入歌曲描述,进行歌词生成或编辑。
产品定价
各模型的定价说明、计费方式及使用限制。
速率限制
为保证资源的高效使用,引入速率限制,以确保服务的可用性、稳定性。