什么是同声传译
同声传译能力将语音识别、实时翻译与语音播报整合为一条完整链路。你可以在讲话过程中持续获取原文和译文,并按需实时播报翻译结果。 当前支持 11 种语言:中文、英语、日语、韩语、粤语、德语、法语、西班牙语、葡萄牙语、意大利语和俄语。核心能力
- 实时识别与翻译:持续接收语音并实时生成原文与译文。
- 源语言自动识别:支持自动识别输入语言,减少开始前配置。
- 实时译文播报:支持将译文实时转换为语音,并提供男声、女声两种预制音色。
- 同传结果留存:结束后支持单条译文回听,并可下载原文与译文文本。
主要特性
- 原文与译文同步展示:同传过程中实时查看识别原文与对应译文,便于理解和核对。
- 实时译文播报:开启播报后,译文可同步转换为语音播放,并支持男声、女声两种预制音色。
- 语音降噪:支持对输入语音进行降噪处理,适用于会议、活动现场等存在环境噪声的场景。
- 结果回听与下载:同传结束后可逐条回听译文,并下载翻译前后的文本内容。
- 断网重连:网络短暂中断后支持重新连接,降低网络波动对使用过程的影响。
模型版本
当前同声传译模块使用以下模型:sensenova-livetranslate-1.0。
API 能力概览
SenseAudio 同声传译提供基于 WebSocket 的实时接口。建立 WebSocket 连接后,你可以持续发送实时音频,服务端会流式返回识别原文、译文以及可选的译文语音。 接口地址:GET wss://api.senseaudio.cn/ws/v1/audio/simulat-interpreting
参数选择建议
典型应用场景
跨语言会议与商务沟通
实时生成原文与译文,并通过译文播报帮助不同语言的参与者同步理解会议内容。国际活动与现场交流
适用于论坛、发布会、展会等场景,为现场讲话提供实时跨语言翻译。直播与实时内容
为访谈、直播和在线内容实时生成双语文本及译文语音,提升跨语言内容触达效率。开始使用
1
获取 API Key
前往 API 密钥 创建你的 API Key。
2
配置同传语言
选择目标语言,源语言可指定或使用自动识别。
3
建立同传连接
通过 WebSocket 创建同声传译任务,并持续发送实时音频。
4
获取同传结果
实时接收原文、译文以及可选的译文语音,结束后可进一步保存或处理同传结果。
相关资源
模型列表
查看同声传译模型与其他可调用模型。
计费规则
查看同声传译按时长计费规则。