功能介绍
基于参考音频,快速复刻并生成音色 ID,后续用于语音合成。
前提条件
在使用本功能前,您需完成以下前置操作:
腾讯云账号注册/登录、开通 MPS 产品、完成服务角色授权。
若您使用腾讯云子账号,还需要保证账号有足够权限使用 MPS 产品。
指定音色复刻引擎
MPS 音色复刻支持一系列丰富引擎,部分常用引擎包括:
引擎 | 特性 |
MiniMax | 能力均衡,支持长文本。适合有声书、中文内容工厂、数字人对话等场景。 |
TTS-F2-emotional(待上线) | 情绪细粒度控制强。适合短剧、多角色演播、情感戏等场景。 |
说明:
使用指定引擎复刻的音色 ID,只能用该引擎进行语音合成。
如需完整清单,请与我们联系。同时,请提供使用场景、用量等必要信息以便评估。
计费说明
说明:
目前只要音色复刻任务成功,就会收取"克隆音色"费用。
后续计划支持以下计费逻辑:使用 MiniMax 引擎复刻时,先生成临时音色和试听音频,只收取试听费用;7天内使用该音色进行正式语音合成后,才会入库该音色并收取"克隆音色"费用。
发起音色复刻任务
ExtParam 参数 | 类型 | 必填 | 描述 |
engine | String | 否 | 指定引擎名,支持 minimax 等。 |
说明:
输入的音频时长没有限制,为提高复刻效果,建议时长控制在10秒-20秒之间,且仅包含单人清晰语音。
输入示例:
{"AudioData": "UklGRghoAABXQVZFZm10IBAAAAABAAEAgD4AAAB...",//音频base64编码"ExtParam": "{\\"engine\\":\\"minimax\\"}"}
输出示例:
{"Response": {"ErrorCode": 0,"Msg": "success","VoiceId": "v1_jRFTM0hdReIsnPll+lDRCpW6+3Drq0RcmXwUTiCOGUiTuv3aNPOainIwzGPtKXaeLGs=","RequestId": "15468f21-9d4a-4958-b652-454d6f7646ea"}}