语音翻译设置
在这里配置语音翻译的识别模型、麦克风与扬声器设备、翻译语言以及翻译结果显示与 VRChat Chatbox 发送等选项。功能使用说明请参阅 语音翻译。
功能设置
- 开启语音翻译:语音翻译的总开关。开启后,主程序会启动 ASR 工作进程并开始采集音频。
- 语音识别模型:选择本地语音识别模型的档位。
- 快速(0.6B)(默认):响应更快,占用内存更少。
- 高精度(1.7B):准确率更高,占用更多内存(约需 3 GB 可用内存)。
- 推理核心数:语音识别与本地翻译所使用的 CPU 核心数(范围
1~ 设备核心数,默认4)。 - 模拟流式输出:开启后按约 1 秒的间隔增量输出识别中间结果,显示更接近实时字幕;关闭则仅在整句识别完成后一次输出。
扬声器语音翻译设置
针对扬声器回环采集(即游戏内、语音通话中对方说的话)进行配置:
- 语音识别语言:设置扬声器音频识别时使用的语言,默认为"自动",由系统自动判定语种。
- 翻译源语言 / 翻译目标语言:设定扬声器所识别文字的翻译来源与目标语言。目标语言通常设置为您的母语,用来看懂对方在说什么。
麦克风语音翻译设置
针对麦克风(即您自己说的话)进行配置,用于把您的话翻译给他人:
- 语音识别语言:默认"自动"。
- 翻译源语言 / 翻译目标语言:设定您所说话语的翻译方向,例如源语言中文、目标语言英语,方便在多语言社交中与外国玩家交流。
音频设备设置
- 刷新设备列表:点击后重新枚举当前可用的输入 / 回环设备。
- 麦克风设备:选择采集您声音的输入设备。
- 扬声器设备:选择用于回环采集系统声音的设备。
翻译结果显示设置
- 显示模式:对照模式(同时显示原文与译文)或仅译文模式(只显示译文)。
- 翻译结果对齐:译文面板内文字的左对齐 / 居中对齐 / 右对齐。
- 翻译结果流动方式:新增内容的滚动方向,可选自动 / 向上 / 向下。
- 背景透明度:译文面板背景的透明度(
0.0~1.0,默认0.5)。 - 字体大小:译文文字的缩放比例(
0.5x~2.0x,默认1.0x)。 - 宽度 / 高度:译文面板在视野中的占比,可在
10% ~ 60%(宽度)与5% ~ 30%(高度)之间调节。 - X 位置 / Y 位置:译文面板中心的显示位置(
0% ~ 100%)。 - 景深(米):译文面板在 VR 空间中的显示深度距离(
0.5~10.0米,默认2.0)。 - 翻译结果显示方式:跟随(译文面板跟随视线移动)或固定(固定锚定在 VR 空间某处)。
VRChat Chatbox (OSC)
将语音翻译结果通过 OSC 协议自动发送到 VRChat 的 Chatbox 聊天框:
- 发送扬声器翻译文本到 Chatbox:是否发送扬声器(对方说话)的译文。
- 发送麦克风翻译文本到 Chatbox:是否发送麦克风(您自己说话)的译文。
- OSC 端口:VRChat 接收端口,默认为
9000。 - OSC 消息模式:对照模式(译文在上、原文在下)或仅译文模式。
- 消息留存条数:聊天框中保留的历史消息条数(
1~10,默认2)。
提示:语音翻译需要 ASR 工作进程正常运行。若该项无法启用或异常,请确认软件安装目录完整、并查看是否为杀毒软件拦截了子进程。