Skip to main content
人声分离能力可从上传音频中分离人声轨道,适用于音频后期处理、素材清洗、语音内容分析前处理等场景。

接入方式

同步人声分离

上传音频并等待处理完成,接口直接返回分离结果 URL。

异步人声分离

上传音频并创建任务,适合不希望长时间保持 HTTP 连接的场景。

查询任务结果

使用 task_id 查询任务状态,并在完成后获取 result_url

推荐流程

  1. 对于短音频或需要直接拿到结果的场景,调用同步人声分离
  2. 对于耗时较长或需要后台处理的场景,调用异步人声分离创建任务。
  3. 异步任务创建成功后,使用查询人声分离任务轮询任务状态。

模型

音频要求

  • 上传字段固定为 file
  • 支持的音频格式、时长与文件大小限制以服务端校验规则为准
  • 当文件不符合模型要求或音频格式非法时,服务端将返回 400