听觉模块:配置语音识别让 AIRI 听懂你说话
听觉(STT / 语音识别)把你的话变成文字送进对话。官方语音文档同样给出三步:配凭据、选模型、测麦克风。
三步配置
- 配凭据:「设置 → 服务来源 → 语音识别」选服务商并填写凭据。阿里云实时识别等服务商都有专属页面,OpenAI 兼容的转写接口也能接。
- 选模型:「设置 → 机体模块 → 听觉」选中已配的服务商和模型。
- 选麦克风并测试:选对输入设备,说一句短话,在识别结果区确认文字出现。
语音输入的三个实用开关
- 自动发送转录文本(Auto-send transcribed text):开启后识别文字按设定的延迟自动发出;关闭则先显示出来,你检查修改后手动发。
- 自动发送延迟(Auto-send delay):自动发出的等待时间,怕截断就调长一点。
- 灵敏度(Sensitivity):配合「start monitoring」监听测试调整,说话检测更准。
AIRI 正在说话时会暂停收音,避免把她自己的声音又识别进去——这是官方说明的行为,不是故障。
两个已知坑
- macOS:首次使用语音输入需要一次性授权麦克风,弹窗选「允许」,否则功能不可用。
- 网页版:浏览器自带的语音识别对中文支持不完整,中文用户基本都要新建一个识别来源,见中文语音方案。
不想让她听
听觉页同样可选「无」,随时静默。
接下来
- 说话没反应?麦克风权限与收音测试。
- 转录文字想免手动发送:自动发送转录文本。