Skip to main content
除了系统音色外,SenseAudio 提供两种自定义音色生成方式:通过 参考音频复刻 的音色克隆,以及通过 自然语言描述生成 的文生音色。两者共享同一组生成次数额度,次数额度由套餐等级决定。生成完成后,均可使用对应的 voice_id语音合成 API语音合成 WebSocket API 中调用。
文生音色与音色克隆共用同一组生成次数额度。每次保存成功会消耗一次额度;是否可直接通过 API 调用,请以文档页展示的 音色列表 为准。

音色克隆

音色克隆大模型是基于全新自研语音大模型算法打造的高效化、专业级音色定制方案。用户仅需录制几秒音频,即可快速拥有高保真的专属 AI 定制音色。

产品优势

  • 技术领先:采用全新自研大模型技术,提供行业领先的复刻精度与情感表现力。
  • 超低成本:仅需录制 3-30 秒 音频即可快速复刻,录制门槛极低。
  • 高度还原:1:1 还原真人音色特点、说话风格、口音和声学细节。
  • 极速复刻:数秒完成模型训练与音色生成,即刻拥有高品质 AI 定制音色。

使用流程

1

确认剩余次数

剩余生成次数是进行音色克隆的必要条件。每次保存成功会消耗一次额度,生成后的音色在套餐有效期内可用于平台合成或 API 调用。
2

在平台录制并克隆

  • 环境要求:在安静、无回声环境下录制,确保人声纯净。
  • 素材规格:时长 3-30 秒、体积 50MB 以内、格式 MP3/WAV/AAC
  • 操作步骤
    1. 添加音频:选择“录制音频”或“上传音频”。
    2. 音色克隆:保存成功后系统消耗一次生成额度,数秒完成音色克隆。
    3. 管理音色:在音色列表查看已生成的音色并使用。
3

通过 API 调用

克隆音色 API 暂不支持直接通过接口发起录制请求;请先在平台完成音色复刻,获取 voice_id 后,再传入 语音合成 API

文生音色

文生音色功能是基于自研的音色合成模型打造的个性化、无版权风险的 AI 音色解决方案。用户仅需通过自然语言描述,即可定制逼真、自然、符合需求的 AI 音色。

适用场景

文生音色能力面向个性化配音、角色语音定制、品牌音色设计等场景,支持通过文本描述快速生成新的专属音色。相比传统录音采集或复杂训练流程,文生音色更适合用于快速创作和批量探索不同声线方案。

使用流程

1

确认剩余次数

剩余生成次数是进行音色生成的必要条件。每次保存成功会消耗一次额度,生成后的音色在套餐有效期内可用于平台合成或 API 调用。
2

在平台完成生成

文生音色相关流程以平台侧生成与管理为主,暂不支持通过接口直接生成音色。
3

通过 API 调用

生成完成后,获取唯一 voice_id 并传入 语音合成 API。是否可直接通过 API 调用,请以 音色列表 为准。

套餐权益与扩容支持

音色克隆与文生音色共用同一组生成次数额度,次数额度由您的套餐等级决定,并随套餐有效期动态调整。免费生成次数用完后,您也可以按需购买生成次数,价格为 9.9 元 / 次

次数不足处理方案

当生成次数不足时,您可以通过以下方式继续使用:
  • 查看剩余额度:您可以在平台查看当前套餐下的剩余生成次数,确认是否还能继续使用文生音色或克隆音色功能。
  • 购买次数:套餐内次数用完后,可按 9.9 元 / 次 购买额外次数。若账户内有可用代金券或余额,系统将直接抵扣;若代金券和余额均不足,需先充值后再继续使用。
  • 升级套餐:如需更高的基础额度,可点击“升级套餐”获取更多套餐内生成次数。

相关资源

音色列表

查看系统音色清单与套餐可调用范围。

查询可用音色

确认当前账号可调用的 voice_id