Harness Trust
插件商店
检查已安装插件
搜索插件、npm 包名或仓库
EN
首页
/
插件商店
/
语音与音频
/
@zhangbo-cn/dsh-client-ui-voice-input
@zhangbo-cn/dsh-client-ui-voice-input
@Zhangbo-cn · 语音与音频
检测未发现问题
无安装脚本
来源一致
为 DSH Web UI 输入框添加语音功能:可持续听写文字,也可按住说话直接发送并朗读回复。
v0.1.1
版本
npm 预构建包
安装方式
2026-08-22
最近更新
6 · 327
Star · 周下载
复制安装命令
dsh plugin --profile web add @zhangbo-cn/dsh-client-ui-voice-input
查看仓库
插件介绍
根据仓库资料整理 · commit 4fffe13
主要功能
点击麦克风进入持续监听模式,语音逐字实时转写进输入框,可随时发送或继续说话。
按住麦克风录音,松开即发送本次语音转成的消息。
发送语音消息后自动朗读助手回复,优先使用 host 的 Edge TTS,浏览器 speechSynthesis 作为兜底方案。
回复朗读采用分句流式播放,模型仍在生成时已开始逐句朗读。
朗读期间自动暂停语音识别以防止回声,朗读结束后自动恢复监听。
可配置识别语言(默认 zh-CN)及是否显示中间识别结果。
适合什么时候用
希望在 DSH Web UI 中免打字、用语音持续输入长文本的用户。
希望进行类似语音对话的交互,说完自动发送并听到回复朗读的用户。
偏好语音交互、减少手动操作的可访问性场景。
安装后会多出什么
界面
输入框工具栏中的线性麦克风按钮(监听/朗读时呈 DeepSeek 蓝色脉动)。
使用前需要
浏览器需支持 Web Speech API(Chrome/Edge/Safari 可用麦克风识别,Firefox 不支持语音输入,仅为浏览器自身限制)。
建议同时挂载 host 端的 @deepseek-ai/dsh-tts-edge 能力以提供 /api/tts,否则回复朗读会退化为浏览器自带的 speechSynthesis。
依赖 @deepseek-ai/dsh-client-locale、@deepseek-ai/dsh-client-ui-conversation、@deepseek-ai/dsh-client-runtime、@deepseek-ai/dsh-client-ui-slots、@deepseek-ai/dsh-invariants、@deepseek-ai/cordis 等 DSH 客户端包。
无需任何 API Key:浏览器端语音识别与朗读均本地/经 host 处理。
在 GitHub 阅读完整 README
权限与能力
安装后它能碰到什么
不覆盖任何 dsh-base 宿主行:不接管沙箱、审批、凭据等能力。
宿主能力
浏览器 UI
环境变量
宿主子进程
能力是范围不是结论:很多能力是功能所需。
基本信息
仓库
Zhangbo-cn/dsh-voice-input-plugin
npm
@zhangbo-cn/dsh-client-ui-voice-input@0.1.0
安装方式
npm 预构建包
收录日期
2026-08-16
固定 commit
4fffe1300765
· 2026-08-22
dsh plugin --profile web add @zhangbo-cn/dsh-client-ui-voice-input
复制
@zhangbo-cn/dsh-client-ui-voice-input — DeepSeek Harness 插件商店 · Harness Trust