Skip to main content
SenseAudio 开放平台提供覆盖文本、语音、图像、视频、音乐、智能体六大方向的 RESTful API。所有接口采用统一的鉴权方式与错误语义,开发者可基于本页快速定位所需能力。

服务地址

所有接口均在以下地址提供服务:

鉴权

所有接口均使用 Bearer Token 鉴权,请在请求头中携带您的 API Key:
API Key 的创建与管理详见 快速接入,或直接前往 SenseAudio API 平台 API 密钥

接口分组

语音合成

将文本合成为富有情感的 AI 语音,支持多情绪、多风格、多音字纠正、公式朗读。

语音识别

音频转写、质检分析与历史记录查询,覆盖通用、极速、语义、整编、质检五档模型。

人声分离

上传音频并分离人声,支持同步返回结果或异步轮询任务状态。

文本生成

兼容 OpenAI / Anthropic 协议的多模态大模型接口,支持对话、消息与响应三种风格。

图片生成

同步 / 异步图片生成与任务状态查询,覆盖常规尺寸与高分辨率输出。

音乐生成

歌词生成与完整歌曲合成,支持风格控制、结构化歌词与纯音乐模式。

视频生成

视频生成服务面向短视频创作、营销素材制作、内容可视化和创意分镜生成等场景。

实时智能体

实时语音对话式智能体,支持会话邀请、状态查询与离会。

自定义智能体

创建、更新、查询与删除自定义智能体,可绑定 LLM 模型与系统音色。

全部接口一览

语音合成

音色

语音识别

人声分离

文本生成

图片生成

音乐生成

视频生成

实时智能体

自定义智能体

通用约定

  • 请求格式:除文件上传外,均使用 application/json 作为请求体格式
  • 响应格式:所有响应均为 application/json,UTF-8 编码
  • 幂等与重试:对于耗时较长的生成类任务(图片异步、视频、音乐),创建接口会返回 task_id,请通过对应的状态查询接口轮询结果
  • 错误码:HTTP 状态码遵循标准语义;响应体中包含 codemessage 字段描述错误详情

相关资源

快速接入

获取 API Key 并完成首个请求。

模型列表

浏览全部可调用模型与能力概览。

API 计费

查看各项 API 的积分消耗规则。

常见问题

接入过程中的常见问题解答。