Skip to main content
SenseAudio 同声传译服务面向跨语言会议、实时交流、直播与国际活动等场景,提供实时语音识别、翻译与译文播报能力。服务支持源语言自动识别,并可在同传过程中同步查看原文与译文。

什么是同声传译

同声传译能力将语音识别、实时翻译与语音播报整合为一条完整链路。你可以在讲话过程中持续获取原文和译文,并按需实时播报翻译结果。 当前支持 11 种语言:中文、英语、日语、韩语、粤语、德语、法语、西班牙语、葡萄牙语、意大利语和俄语。

核心能力

  • 实时识别与翻译:持续接收语音并实时生成原文与译文。
  • 源语言自动识别:支持自动识别输入语言,减少开始前配置。
  • 实时译文播报:支持将译文实时转换为语音,并提供男声、女声两种预制音色。
  • 同传结果留存:结束后支持单条译文回听,并可下载原文与译文文本。

主要特性

  • 原文与译文同步展示:同传过程中实时查看识别原文与对应译文,便于理解和核对。
  • 实时译文播报:开启播报后,译文可同步转换为语音播放,并支持男声、女声两种预制音色。
  • 语音降噪:支持对输入语音进行降噪处理,适用于会议、活动现场等存在环境噪声的场景。
  • 结果回听与下载:同传结束后可逐条回听译文,并下载翻译前后的文本内容。
  • 断网重连:网络短暂中断后支持重新连接,降低网络波动对使用过程的影响。

模型版本

当前同声传译模块使用以下模型:sensenova-livetranslate-1.0

API 能力概览

SenseAudio 同声传译提供基于 WebSocket 的实时接口。建立 WebSocket 连接后,你可以持续发送实时音频,服务端会流式返回识别原文、译文以及可选的译文语音。 接口地址:GET wss://api.senseaudio.cn/ws/v1/audio/simulat-interpreting

参数选择建议

典型应用场景

跨语言会议与商务沟通

实时生成原文与译文,并通过译文播报帮助不同语言的参与者同步理解会议内容。

国际活动与现场交流

适用于论坛、发布会、展会等场景,为现场讲话提供实时跨语言翻译。

直播与实时内容

为访谈、直播和在线内容实时生成双语文本及译文语音,提升跨语言内容触达效率。

开始使用

1

获取 API Key

前往 API 密钥 创建你的 API Key。
2

配置同传语言

选择目标语言,源语言可指定或使用自动识别。
3

建立同传连接

通过 WebSocket 创建同声传译任务,并持续发送实时音频。
4

获取同传结果

实时接收原文、译文以及可选的译文语音,结束后可进一步保存或处理同传结果。

相关资源

模型列表

查看同声传译模型与其他可调用模型。

计费规则

查看同声传译按时长计费规则。