服务地址
所有接口均在以下地址提供服务:鉴权
所有接口均使用 Bearer Token 鉴权,请在请求头中携带您的 API Key:接口分组
语音合成
将文本合成为富有情感的 AI 语音,支持多情绪、多风格、多音字纠正、公式朗读。
语音识别
音频转写、质检分析与历史记录查询,覆盖通用、极速、语义、整编、质检五档模型。
人声分离
上传音频并分离人声,支持同步返回结果或异步轮询任务状态。
文本生成
兼容 OpenAI / Anthropic 协议的多模态大模型接口,支持对话、消息与响应三种风格。
图片生成
同步 / 异步图片生成与任务状态查询,覆盖常规尺寸与高分辨率输出。
音乐生成
歌词生成与完整歌曲合成,支持风格控制、结构化歌词与纯音乐模式。
视频生成
视频生成服务面向短视频创作、营销素材制作、内容可视化和创意分镜生成等场景。
实时智能体
实时语音对话式智能体,支持会话邀请、状态查询与离会。
自定义智能体
创建、更新、查询与删除自定义智能体,可绑定 LLM 模型与系统音色。
全部接口一览
语音合成
音色
语音识别
人声分离
文本生成
图片生成
音乐生成
视频生成
实时智能体
自定义智能体
通用约定
- 请求格式:除文件上传外,均使用
application/json作为请求体格式 - 响应格式:所有响应均为
application/json,UTF-8 编码 - 幂等与重试:对于耗时较长的生成类任务(图片异步、视频、音乐),创建接口会返回
task_id,请通过对应的状态查询接口轮询结果 - 错误码:HTTP 状态码遵循标准语义;响应体中包含
code与message字段描述错误详情
相关资源
快速接入
获取 API Key 并完成首个请求。
模型列表
浏览全部可调用模型与能力概览。
API 计费
查看各项 API 的积分消耗规则。
常见问题
接入过程中的常见问题解答。