Skip to main content
POST
语音合成 (TTS)

说明

将文本合成为高自然度的语音音频,支持 70+ 系统音色、克隆音色与文生音色。本页介绍非流式合成(stream=false),一次性返回完整音频。

相关指南

授权

Authorization
string
header
必填

格式:Bearer <API_KEY>

请求体

application/json
model
enum<string>
默认值:senseaudio-tts-1.5-260319
必填

TTS 模型 ID。senseaudio-tts-1.5-260319 为推荐版本(情绪/多音字/公式朗读支持,且支持克隆与文生音色);

可用选项:
senseaudio-tts-1.5-260319
示例:

"senseaudio-tts-1.5-260319"

text
string
必填

合成文本,最大 10000 字符,支持 停顿符。其中time 单位为毫秒(ms)、500 表示停顿 500 毫秒、最小值为 100 毫秒,最大值无限制。

示例:

"你好,这是来自 <break time=500> SenseAudio 的第一条语音"

voice_setting
object
必填
stream
enum<boolean>
默认值:false

非流式合成必须为 false(流式请参考 语音合成 HTTP 流式 接口)

可用选项:
false
示例:

false

audio_setting
object
dictionary
object[]
示例:
stream_options
object

响应

成功

data
object
extra_info
object
trace_id
string
base_resp
object

通用状态结构