@zhangbo-cn/dsh-client-ui-voice-input

@Zhangbo-cn · 语音与音频
检测未发现问题无安装脚本来源一致

为 DSH Web UI 输入框添加语音功能:可持续听写文字,也可按住说话直接发送并朗读回复。

v0.1.1版本
npm 预构建包安装方式
2026-08-22最近更新
6 · 327Star · 周下载
dsh plugin --profile web add @zhangbo-cn/dsh-client-ui-voice-input查看仓库

插件介绍

根据仓库资料整理 · commit 4fffe13

主要功能

  • 点击麦克风进入持续监听模式,语音逐字实时转写进输入框,可随时发送或继续说话。
  • 按住麦克风录音,松开即发送本次语音转成的消息。
  • 发送语音消息后自动朗读助手回复,优先使用 host 的 Edge TTS,浏览器 speechSynthesis 作为兜底方案。
  • 回复朗读采用分句流式播放,模型仍在生成时已开始逐句朗读。
  • 朗读期间自动暂停语音识别以防止回声,朗读结束后自动恢复监听。
  • 可配置识别语言(默认 zh-CN)及是否显示中间识别结果。

适合什么时候用

  • 希望在 DSH Web UI 中免打字、用语音持续输入长文本的用户。
  • 希望进行类似语音对话的交互,说完自动发送并听到回复朗读的用户。
  • 偏好语音交互、减少手动操作的可访问性场景。

安装后会多出什么

界面输入框工具栏中的线性麦克风按钮(监听/朗读时呈 DeepSeek 蓝色脉动)。

使用前需要

  • 浏览器需支持 Web Speech API(Chrome/Edge/Safari 可用麦克风识别,Firefox 不支持语音输入,仅为浏览器自身限制)。
  • 建议同时挂载 host 端的 @deepseek-ai/dsh-tts-edge 能力以提供 /api/tts,否则回复朗读会退化为浏览器自带的 speechSynthesis。
  • 依赖 @deepseek-ai/dsh-client-locale、@deepseek-ai/dsh-client-ui-conversation、@deepseek-ai/dsh-client-runtime、@deepseek-ai/dsh-client-ui-slots、@deepseek-ai/dsh-invariants、@deepseek-ai/cordis 等 DSH 客户端包。
  • 无需任何 API Key:浏览器端语音识别与朗读均本地/经 host 处理。

在 GitHub 阅读完整 README

权限与能力

安装后它能碰到什么
不覆盖任何 dsh-base 宿主行:不接管沙箱、审批、凭据等能力。
宿主能力
浏览器 UI环境变量宿主子进程
能力是范围不是结论:很多能力是功能所需。

基本信息

仓库Zhangbo-cn/dsh-voice-input-pluginnpm@zhangbo-cn/dsh-client-ui-voice-input@0.1.0安装方式npm 预构建包收录日期2026-08-16固定 commit4fffe1300765 · 2026-08-22
dsh plugin --profile web add @zhangbo-cn/dsh-client-ui-voice-input