dsh-ears

@WizisCool · 语音与音频
检测未发现问题无安装脚本来源一致

面向 DeepSeek Harness 的语音输入插件,通过麦克风把语音转成可编辑草稿并可选润色

v0.1.2版本
npm 预构建包安装方式
2026-08-21最近更新
7 · 187Star · 周下载
dsh plugin --profile web add dsh-ears查看仓库

插件介绍

根据仓库资料整理 · commit 9449220

主要功能

  • 输入框麦克风按钮把语音转成可编辑的草稿文本,需手动确认发送
  • 支持多种识别后端:浏览器 Web Speech、本地 Whisper、Groq、阿里云百炼,以及任意 OpenAI 兼容转写接口
  • 可选用 dsh 中已接入的任意 LLM 对转写结果润色,去口头禅、修 ASR 错字、处理自我纠正等,提示词可自定义
  • 提供原生设置页,用于配置识别后端、润色模型与提示词
  • 默认快捷键 Ctrl+Shift+Space 唤起语音输入
  • 润色失败或取消时自动保留原始转写文本

适合什么时候用

  • 想用语音代替打字快速输入 prompt 的 dsh 用户
  • 需要在本地或云端多种语音识别方案间灵活切换的用户
  • 希望转写文本自动去口头禅、修错字后再发送的用户

安装后会多出什么

界面输入框内的麦克风按钮 · 插件原生设置页

使用前需要

  • DeepSeek Harness 版本需在 0.1.0-rc.6 至 0.1.1-rc.2 之间
  • Node.js ^22.19.0 或 >=24.0.0
  • 按所选识别后端不同,可能需要:Chromium 内核浏览器(Web Speech)、预装 openai-whisper 并下载模型(本地 Whisper)、Groq API key、阿里云百炼 API key/端点/模型名,或自定义 OpenAI 兼容端点信息
  • 润色功能复用 dsh 中已配置的 LLM 及其 API key

在 GitHub 阅读完整 README

权限与能力

安装后它能碰到什么
不覆盖任何 dsh-base 宿主行:不接管沙箱、审批、凭据等能力。
宿主能力
Agent 控制浏览器 UI凭据环境变量文件系统外部网络宿主子进程遥测
能力是范围不是结论:很多能力是功能所需。

基本信息

仓库WizisCool/dsh-earsnpmdsh-ears@0.1.1安装方式npm 预构建包收录日期2026-08-19固定 commit94492204807f · 2026-08-21
dsh plugin --profile web add dsh-ears