@nn12138/dsh-voice

@3274375092 · 语音与音频
检测未发现问题无安装脚本

面向 DeepSeek Harness 网页端的语音输入插件,说话即转文字发送为聊天消息

v0.2.6版本
GitHub 源码安装安装方式
2026-08-21最近更新
6Star
dsh plugin --profile web add github:3274375092/dsh-voice查看仓库

插件介绍

根据仓库资料整理 · commit ceab3e7

主要功能

  • 在聊天输入框旁提供麦克风按钮和可配置全局快捷键(默认 Ctrl+Space)用于语音输入
  • 说话过程中实时显示流式识别的部分文本,停止后通过 VAD 判定句尾并提交最终文本
  • 双引擎自适应:优先使用本机离线 ASR(sherpa-onnx-node + silero VAD),不可用时自动回退到浏览器 Web Speech
  • 仅作为输入方式,不修改 agent 的预设/人格,兼容 code/standard/minimal/custom 等各种 preset
  • 开箱即用无需配置,若需本机离线识别可运行独立命令下载模型(约 100MB)

适合什么时候用

  • 希望通过语音而非打字向 DeepSeek Harness 提交聊天消息
  • 对数据隐私敏感、希望语音识别完全离线在本机完成
  • 在不便打字的场景下(如移动办公)快速用语音输入指令

安装后会多出什么

界面聊天输入框左侧的麦克风按钮 · 说话时的实时部分识别文本回显
命令dsh-voice-models

使用前需要

  • 需要 DSH web profile(依赖 @deepseek-ai/dsh-client-runtime 与 @deepseek-ai/dsh-client-connection,platform: web)
  • 依赖 @deepseek-ai/cordis 作为 peer dependency
  • 浏览器需授权麦克风访问权限
  • 如需本机离线识别,需额外安装 sherpa-onnx-node 并下载语音模型(插件本身不会自动安装该运行时)

在 GitHub 阅读完整 README

权限与能力

安装后它能碰到什么
不覆盖任何 dsh-base 宿主行:不接管沙箱、审批、凭据等能力。
宿主能力
浏览器 UI环境变量文件系统外部网络会话数据宿主子进程
能力是范围不是结论:很多能力是功能所需。

基本信息

仓库3274375092/dsh-voice安装方式GitHub 源码安装(需 allowBuilds)安装提示源码安装会在你的机器上执行 prepare 构建,需要 allowBuilds 授权;建议用 github:3274375092/dsh-voice#ceab3e7 锁定本次检测的 commit。收录日期2026-08-16固定 commitceab3e7e756d · 2026-08-21
dsh plugin --profile web add github:3274375092/dsh-voice