帮你快速理解、总结文档立即下载

音色复刻

最近更新时间:2026-07-09 16:14:31

我的收藏

功能介绍

基于参考音频,快速复刻并生成音色 ID,后续用于语音合成。

前提条件

在使用本功能前,您需完成以下前置操作:
腾讯云账号注册/登录、开通 MPS 产品、完成服务角色授权
若您使用腾讯云子账号,还需要保证账号有足够权限使用 MPS 产品。
具体指引请参考 快速入门。账号授权问题可参考 账号授权 文档。

指定音色复刻引擎

MPS 音色复刻支持一系列丰富引擎,部分常用引擎包括:
引擎
特性
MiniMax
能力均衡,支持长文本。适合有声书、中文内容工厂、数字人对话等场景。
TTS-F2-emotional(待上线)
情绪细粒度控制强。适合短剧、多角色演播、情感戏等场景。
说明:
使用指定引擎复刻的音色 ID,只能用该引擎进行语音合成。
如需完整清单,请与我们联系。同时,请提供使用场景、用量等必要信息以便评估。

计费说明

使用音色复刻能力,每次任务成功,收取“克隆音色”费用,详细定价请参考 计费说明文档
说明:
目前只要音色复刻任务成功,就会收取"克隆音色"费用。
后续计划支持以下计费逻辑:使用 MiniMax 引擎复刻时,先生成临时音色和试听音频,只收取试听费用;7天内使用该音色进行正式语音合成后,才会入库该音色并收取"克隆音色"费用。

发起音色复刻任务

调用 同步配音 接口,传入待复刻的音频,即可实现极速复刻。可以通过扩展 ExtParam 指定引擎,若不传,默认为 MiniMax。
ExtParam 参数
类型
必填
描述
engine
String
指定引擎名,支持 minimax 等。
说明:
输入的音频时长没有限制,为提高复刻效果,建议时长控制在10秒-20秒之间,且仅包含单人清晰语音。
输入示例:
{
"AudioData": "UklGRghoAABXQVZFZm10IBAAAAABAAEAgD4AAAB...",//音频base64编码
"ExtParam": "{\\"engine\\":\\"minimax\\"}"
}
输出示例:
{
"Response": {
"ErrorCode": 0,
"Msg": "success",
"VoiceId": "v1_jRFTM0hdReIsnPll+lDRCpW6+3Drq0RcmXwUTiCOGUiTuv3aNPOainIwzGPtKXaeLGs=",
"RequestId": "15468f21-9d4a-4958-b652-454d6f7646ea"
}
}