语音输入

使用语音转写面板将口述内容插入 AI 对话

语音输入

Knodo 的语音输入用于把口述内容转写成文字,再由用户确认后插入聊天输入框。转写结果不会自动发送,确认前也不会改写已有草稿。

入口

在工作空间右侧聊天区的消息输入工具栏中点击麦克风图标,即可打开语音转写面板。面板会显示在消息输入框上方,与输入框同宽。

当前版本沿用桌面端工具栏入口,不新增移动端入口。

语音转写面板

使用流程

  1. 点击麦克风图标打开语音转写面板。
  2. 浏览器请求麦克风权限时选择允许。
  3. 面板进入录音状态后开始说话。
  4. 点击“停止”结束当前录音段。
  5. 在审核状态下检查并编辑转写文本。
  6. 点击“插入”后,文本会写入消息输入框最近一次光标或选区位置。
  7. 继续编辑草稿,确认无误后再发送消息。

转写面板

语音面板与消息输入框是两个独立区域:

  • 录音、实时稿、最终稿都保留在面板中。
  • 消息输入框中的草稿、文件上传、命令选择、模型选择、权限模式和发送行为保持不变。
  • 点击“插入”是唯一写入草稿的动作。
  • 插入后只写入文本,不会自动发送消息。

多段录音

停止录音后可以点击“继续录制”。继续录制会创建新的录音段,并把新段追加到同一个面板中。

当前版本不支持同一段录音的暂停和恢复。

说话人

如果语音转写服务返回说话人信息,Knodo 会在当前录音段内显示为“说话人 1”“说话人 2”等匿名标签。

注意:

  • 说话人编号只在当前录音段内有效。
  • 不显示上游原始 speaker id。
  • 不推断真实姓名。
  • 多说话人文本插入时会保留标签和换行,便于后续编辑。

时长与限制

语音输入不显示固定 60 秒倒计时。单次录音时长由实时转写服务和当前组织配置控制。

如果达到服务限制,面板会停止录音并保留已经识别的文本。用户仍可在有文本时插入当前结果。

权限与异常

首次使用时浏览器会请求麦克风权限。权限被拒绝、未找到麦克风、额度不足、服务未配置或网络中断时,面板会显示可行动的错误提示,并保留已识别内容。

常见处理方式:

  • 麦克风权限被拒绝:在浏览器地址栏或站点设置中允许麦克风权限,然后重试。
  • 未找到麦克风:检查系统输入设备或连接外置麦克风。
  • 网络中断:恢复网络后点击“继续录制”。
  • 额度不足或服务未配置:联系组织管理员处理。

关闭有内容或仍在录音的面板时,系统会先释放麦克风资源,再提示确认是否放弃本次转写。