Skip to main content
POST
SenseAudio 音色克隆

说明

使用已上传的参考音频生成克隆音色。调用前请先通过 上传文件 获取 file_id
  • 生成链路:上传音频获取 file_id → 调用本接口生成音色 ID → 在 TTS 接口中使用该音色。
  • 音色 ID:本接口使用 label 作为自定义音色 ID,生成后在 voice_setting.voice_id 中传入该 label
  • 克隆模型:当前使用 sensenova-tts-2.0-clone

调用示例

1. 上传参考音频

上传成功后,从返回结果中读取 file.file_id

2. 生成克隆音色

使用克隆音色

生成成功后,将 label 作为 voice_setting.voice_id 传入 语音合成 HTTP

与 Minimax 兼容接口的区别

授权

Authorization
string
header
必填

格式:Bearer <API_KEY>

请求体

application/json
description
string
必填

音色描述

file_id
string
必填

上传音频返回的 file.file_id

model
string
默认值:sensenova-tts-2.0-clone
必填

克隆模型

示例:

"sensenova-tts-2.0-clone"

text
string
必填

用于试听克隆效果的示例文本

label
string
必填

自定义克隆音色标签,也是生成后的音色 ID

响应

200 - application/json

成功

label
string

克隆音色 ID,对应请求中的 label

name
string

音色名称

description
string

音色描述

created_at
integer

创建时间,UNIX 时间戳

demo
string

试听音频 URL