语音输入与朗读
LanMate 支持三种语音用法:按住说话(语音变文字)、语音对话(连续对话 + 播报)和回复朗读(文字变语音)。使用本地引擎时转写与合成的文字不出本机;配置云端/自建端点(如 FunASR custom)时音频会上传到该端点,以对应服务的隐私政策为准。
按住说话
输入框右侧的麦克风按钮,按住说话,松开后自动转写成文字:
- 转写结果可以直接发送,也可以填入输入框先编辑(设置里可选)
- 说话太短会提示,不产生空消息
- 需要先在设置 → 语音转写与合成中配置转写引擎
适合手边没有键盘、或者口述比打字快的场景。
语音对话
输入框的「语音对话」按钮进入全屏语音模式:
- 开口说话,识别到停顿自动发送
- LanMate 思考时显示状态
- 回复自动播报
- 播报中开口即可打断——不用等它说完
整个过程连续进行,像打电话。实时字幕全程可见,说的话和回复都显示在屏幕上。
回复朗读
消息上的朗读按钮把文字读出来。设置里可以配置:
- 自动朗读:读执行过程中的文本流,还是只读最终回复
- 音色:预设音色试听选择,或用自然语言描述(如「低沉沉稳的男声」)
- 本地合成:在本机运行合成模型,朗读文字不出这台机器
引擎配置
设置 → 语音转写与合成:
| 引擎 | 用途 | 说明 |
|---|---|---|
| 转写模型 | 按住说话、语音附件 | 本地 Whisper 一键安装(自动装依赖 + 下载模型),或配置 FunASR 兼容端点 |
| 实时转写 | 语音对话 | 连续识别,要求低延迟;关闭则语音对话入口不可用 |
| 合成模型 | 朗读 | 本地引擎(MeloTTS / Kokoro / CosyVoice2 三选一,各有安装按钮与音色面板),或第三方服务 |
本地 Whisper 安装:未配置时设置页显示「安装」按钮,自动装依赖进共享环境、流式下载模型(网络失败自动切镜像),进度实时显示。
蓝信语音消息
蓝信渠道收到的语音消息会自动转写成文字,随附件一起进入上下文。在渠道里发语音,桌面端也能处理。