Skip to main content
POST
cURL
cURL

说明

通过提示词生成完整音频。你可以在提示词中编排角色对白、背景音乐和环境音效,并使用平台音色、个人音色或参考音频控制声音表现。
  • 接口地址POST https://api.senseaudio.cn/v1/audio/generate
  • 鉴权方式:Bearer Token,详见 快速接入
  • 模型senseaudio-a1
  • 最大生成时长:120 秒(以 model_duration 计)
  • 计费:按 model_duration 计费,每秒 85 积分。详见 计费规则
生成音频的最终时长为 duration。当设置 speech_rate 时,最终时长可能与模型实际生成时长 model_duration 不同;计费始终以 model_duration 为准。

请求参数

顶层参数

audio_config 参数

references 元素

每个元素提供一条参考音频。
  • http / https URL,例如 https://example.com/test.wav
  • Data URI,例如 data:audio/x-wav;base64,...

使用音色和参考音频

你可以在 prompt 中引用平台音色、个人音色和参考音频:
  • 使用 @<音色标签> 引用平台内置音色或你已生成/克隆的音色,例如 @male_0029_a
  • 使用 @音频<序号> 引用 references 内的参考音频,序号从 1 开始,例如 @音频1
  • 如不希望 @... 被识别为音色或参考音频,请使用反斜杠转义,例如 \@male_0029_a
  • 音色标签数量与参考音频数量之和不得超过 3。

使用参考音频的请求示例

响应参数

响应示例

授权

Authorization
string
header
必填

格式:Bearer <API_KEY>

请求体

application/json
model
string
默认值:senseaudio-a1
必填

音频生成模型。

Allowed value: "senseaudio-a1"
prompt
string
必填

音频生成提示词。可使用 @<音色标签> 引用音色,或使用 @音频<序号> 引用参考音频。

audio_config
object

输出音频配置。所有子字段均为可选。

references
object[]

参考音频列表,单条参考音频不超过 30 秒。

Maximum array length: 3

响应

200 - application/json

生成成功

audio_url
string<uri>

生成音频 URL。

duration
number

最终音频时长,单位秒。

model_duration
number

模型实际生成时长,单位秒,也是计费时长。

subtitle
object

字幕信息。