> ## Documentation Index
> Fetch the complete documentation index at: https://docs.senseaudio.cn/llms.txt
> Use this file to discover all available pages before exploring further.

# 自定义音色

> 音色克隆与文生音色：生成专属 voice_id

除了系统音色外，SenseAudio 提供两种自定义音色生成方式：通过 **参考音频复刻** 的音色克隆，以及通过 **自然语言描述生成** 的文生音色。两者共享同一组生成次数额度，次数额度由套餐等级决定。生成完成后，均可使用对应的 `voice_id` 在 [语音合成 API](/api-reference/endpoint/tts/synthesize-stream) 或 [语音合成 WebSocket API](/api-reference/endpoint/tts/websocket) 中调用。

<Note>
  文生音色与音色克隆共用同一组生成次数额度。每次保存成功会消耗一次额度；是否可直接通过 API 调用，请以文档页展示的 [音色列表](/guides/voice/catalog) 为准。
</Note>

<h2 id="音色克隆">
  音色克隆
</h2>

音色克隆大模型是基于**全新自研语音大模型算法**打造的高效化、专业级音色定制方案。用户仅需录制几秒音频，即可快速拥有高保真的专属 AI 定制音色。

### 产品优势

* **技术领先**：采用全新自研大模型技术，提供行业领先的复刻精度与情感表现力。
* **超低成本**：仅需录制 **3-30 秒** 音频即可快速复刻，录制门槛极低。
* **高度还原**：1:1 还原真人音色特点、说话风格、口音和声学细节。
* **极速复刻**：数秒完成模型训练与音色生成，即刻拥有高品质 AI 定制音色。

### 使用流程

<Steps>
  <Step title="确认剩余次数">
    剩余生成次数是进行音色克隆的必要条件。每次保存成功会消耗一次额度，生成后的音色在套餐有效期内可用于平台合成或 API 调用。
  </Step>

  <Step title="在平台录制并克隆">
    * **环境要求**：在安静、无回声环境下录制，确保人声纯净。
    * **素材规格**：时长 **3-30 秒**、体积 **50MB** 以内、格式 **MP3/WAV/AAC**。
    * **操作步骤**：
      1. **添加音频**：选择“录制音频”或“上传音频”。
      2. **音色克隆**：保存成功后系统消耗一次生成额度，数秒完成音色克隆。
      3. **管理音色**：在音色列表查看已生成的音色并使用。
  </Step>

  <Step title="通过 API 调用">
    克隆音色 API 暂不支持直接通过接口发起录制请求；请先在平台完成音色复刻，获取 `voice_id` 后，再传入 [语音合成 API](/api-reference/endpoint/tts/synthesize)。
  </Step>
</Steps>

<h2 id="文生音色">
  文生音色
</h2>

文生音色功能是基于自研的音色合成模型打造的个性化、无版权风险的 AI 音色解决方案。用户仅需通过自然语言描述，即可定制逼真、自然、符合需求的 AI 音色。

### 适用场景

文生音色能力面向个性化配音、角色语音定制、品牌音色设计等场景，支持通过文本描述快速生成新的专属音色。相比传统录音采集或复杂训练流程，文生音色更适合用于快速创作和批量探索不同声线方案。

### 使用流程

<Steps>
  <Step title="确认剩余次数">
    剩余生成次数是进行音色生成的必要条件。每次保存成功会消耗一次额度，生成后的音色在套餐有效期内可用于平台合成或 API 调用。
  </Step>

  <Step title="在平台完成生成">
    文生音色相关流程以平台侧生成与管理为主，暂不支持通过接口直接生成音色。
  </Step>

  <Step title="通过 API 调用">
    生成完成后，获取唯一 `voice_id` 并传入 [语音合成 API](/api-reference/endpoint/tts/synthesize)。是否可直接通过 API 调用，请以 [音色列表](/guides/voice/catalog) 为准。
  </Step>
</Steps>

## 套餐权益与扩容支持

音色克隆与文生音色共用同一组生成次数额度，次数额度由您的套餐等级决定，并随套餐有效期动态调整。免费生成次数用完后，您也可以按需购买生成次数，价格为 **9.9 元 / 次**。

| **套餐类型**    | **生成次数** | **适用场景**         | **扩容路径**  |
| ----------- | -------- | ---------------- | --------- |
| **Free 版**  | **2 个**  | 基础功能测试与效果预览      | 升级套餐或购买次数 |
| **Lite 版**  | **6 个**  | 个人轻度体验，尝试不同声线    | 升级套餐或购买次数 |
| **Plus 版**  | **10 个** | 满足日常多场景、多角色的配音需求 | 升级套餐或购买次数 |
| **Pro 版**   | **16 个** | 适合高频创作者，建立稳定声线库  | 升级套餐或购买次数 |
| **Max 版**   | **30 个** | 商业化规模应用，支持多场景集成  | 升级套餐或购买次数 |
| **Ultra 版** | **50 个** | 大规模商业化应用与专属需求    | 联系客服定制    |

## 次数不足处理方案

当生成次数不足时，您可以通过以下方式继续使用：

* **查看剩余额度**：您可以在平台查看当前套餐下的剩余生成次数，确认是否还能继续使用文生音色或克隆音色功能。
* **购买次数**：套餐内次数用完后，可按 **9.9 元 / 次** 购买额外次数。若账户内有可用代金券或余额，系统将直接抵扣；若代金券和余额均不足，需先充值后再继续使用。
* **升级套餐**：如需更高的基础额度，可点击“**升级套餐**”获取更多套餐内生成次数。

## 相关资源

<CardGroup cols={2}>
  <Card title="音色列表" icon="user-music" href="/guides/voice/catalog">
    查看系统音色清单与套餐可调用范围。
  </Card>

  <Card title="查询可用音色" icon="list" href="/api-reference/endpoint/voice/list">
    确认当前账号可调用的 `voice_id`。
  </Card>
</CardGroup>
