跳到主要内容

语音识别

系统页面的 语音识别 选项卡。此处决定在 Qubix 对话中发送的语音消息将在何处转换为文字。

录音的处理位置

语音消息识别 开关共有三个位置:

  • 外部 — 录音发送至云端模型处理,费用计入您的 OpenRouter 密钥。
  • 内部 — 录音由运行在本台服务器上的引擎处理,数据不会离开服务器。
  • — 不进行任何转写;语音消息仅以音频形式保留。

切换位置不会重新计算任何内容:语音消息的文字随消息本身一同传输,因此已完成转写的内容保留原有文字,只有新录音才会遵循新的设置。无需重新建立索引,也无需等待。

云端模型

云端模型 行仅在选择 外部 位置时出现——本地引擎内置固定模型,无需选择。

列表中显示每个模型的接收方、模型名称及价格。选择后立即保存。

引擎

引擎 区块为只读。它显示当前使用的模型和识别 语言,以及下方关于当前状态的一行说明:

显示内容含义
语音消息将没有文本开关处于 位置。
转写在云端运行已选择云端位置且运行正常。
凭据中需要一个 OpenRouter 密钥已选择云端位置,但服务器上尚未配置 OpenRouter 密钥。请在连接中添加——在此之前,不会进行任何转写。
转写在此服务器上运行;录音永远不会离开此服务器本地引擎已就绪,录音不会离开服务器。
本地引擎尚未安装在此服务器上已选择本地位置,但该引擎尚未安装在此服务器上。
若本地引擎未到达

选择本地位置后,引擎会开始下载到服务器,文件较大。再次选择同一位置会重新发起下载请求——这正是重试失败下载的方式(无法访问镜像仓库、磁盘空间不足时均可使用)。只要您停留在该选项卡上,它就会自动重新检查,因此很快下载完成的引擎无需刷新页面即可被识别。不过这种检查有时间上限——网络较慢时下载可能超过该上限;如果选项卡仍提示引擎缺失,请刷新页面以重新开始等待。

如果选项卡无法读取自身状态,则会显示 无法加载语音识别状态。重试 按钮,而不是功能卡片——因此,故障不会被误显示为引擎已关闭。

接下来