语音输入¶
听写¶
默认“语音识别”工作流使用 Fn:按住说话,松开结束。识别在本机运行,随后应用词汇规则, 将最终文字保存到语音输入记录,再输入当前应用。需要仅保存记录时,在“设置 → 输入”调整输出方式。
Rill 提供本地 Qwen3-ASR 0.6B 和可选的 1.7B 模型。在“设置 → 语音与模型”准备并启用模型。 更换模型后,以界面中的就绪状态为准。流式文字是预览,最终输出以完整录音识别的结果为准。
“活动”页显示进行中、待处理选择、最近结果和运行历史。识别完成而输出失败时, 先从“全部记录”取回文字,再检查目标输入框和辅助功能权限。
智能整理¶
- 在“设置 → 语音与模型 → API 服务”配置 LLM 的 Base URL、模型和 API Key。
- 使用配置验证动作检查服务,确认所需云端处理授权。
- 在“工作流”启用“智能整理”。它与“语音识别”共用 Fn,启用一个会停用另一个。
- 按 Fn 录音。识别仍在本机完成,整理步骤把文字和要求发送到配置的服务。
智能整理修正明显错字、标点和段落,不把转写里的问题当成需要回答的指令。 LLM Key 保存在 macOS Keychain。兼容服务的参数和可用模型由该服务决定, 选择模型预设不会自动更换服务地址或 Key。
可恢复的网络、限流或超时错误可能保留整理前文字;活动中会显示整理跳过。 取消、隐私阻止、认证等不可继续的错误会停止投递,不会默默换用另一个云服务。
可选的 Jev 润色判断¶
在同一 API 服务章节暂存 TypeSafe Key,然后单独开启“用 Jev 判断是否需要润色”。 Key 与记录候选比较共用,只保留到退出 App; 保存 Key 不会自动开启润色判断,清除 Key 会关闭开关并撤销旧授权。
开启后,支持的智能整理步骤先向 Jev 发送转写文字和润色要求。明确无需修改时, 原文仍会保存并输出;不确定或判断失败时继续原有 LLM 整理。 使用屏幕或记忆参考的运行仍直接进入整理,不把这些参考发送给 Jev。
这是可选的云端判断,可能产生服务用量;它不是离线优化或纠错正确性的保证。
语音助手¶
语音助手默认停用。配置 LLM、准备需要的语音资源并授权后,在“工作流”启用, 再单独开启唤醒监听。默认唤醒短语为“Hey Rill”,也可在设置中修改。
开启监听会持续使用本地麦克风;关闭监听即可停止。助手生成回答,先保存为记录再朗读。 优先使用可用的本地语音合成,必要时回退到系统语音。
改善专有词¶
识别时需要提示名称可使用热词;稳定、可预测的错词替换可使用映射词。 从识别历史提出纠正后,需要确认再加入词库。具体步骤见词汇与记忆。