它为你做了什么
- 通话中每个人都说、都听自己的语言。
- 如果某种语言没有语音翻译,对方会改为阅读字幕。
- 在译文到达之前,你听到的是对方的原声,而不是一片寂静。
如何运作
双方同意后,一个翻译程序会以静默参与者的身份加入通话。它获取每个人的音频,切成短片段,流式发送给云端语音模型,模型识别语音、进行翻译并朗读结果。翻译程序把译语播放到通话中给对方听,对于没有语音的语言则发送字幕。
翻译程序在独立于服务器其他部分的进程中运行,因此同时进行的大量翻译通话不会相互拖慢,也不会拖慢普通聊天。
影响效果的因素
- 双方都有稳定的网络连接。
- 一次只有一个人说话,句子简短。
- 环境安静:背景噪音会降低识别效果。
底层技术
WebRTC · 流式语音识别 · 机器翻译 · 语音合成
常见问题
为了翻译,我的通话会被录音吗?
不会。音频在你说话时流式发送给翻译服务,AiThao 不录制通话。
为什么会有短暂延迟?
语音需要被识别、翻译再重新朗读。延迟取决于网络、语言和每句话的长度。