dsh-voice

@STARDUSTLC666 · 语音与音频
检测未发现问题无安装脚本来源一致

为 DSH agent 添加免费语音合成(edge-tts)与 OpenAI 兼容语音转写(ASR)能力

v0.1.1版本
npm 预构建包安装方式
2026-08-18最近更新
2 · 796Star · 周下载
dsh plugin --profile web add dsh-voice查看仓库

插件介绍

根据仓库资料整理 · commit 109bc83

主要功能

  • voice_tts:调用 edge-tts 协议将文字合成语音(MP3),免费无限量使用,内置 22+ 常用音色
  • voice_stt:通过 OpenAI 兼容 ASR 接口(Groq / OpenAI / 自定义端点)将音频转写为文字
  • voice_list:列出可用的常用语音音色清单
  • 本地实现 edge-tts 的 Sec-MS-GEC 令牌算法,通过 WebSocket 直连微软服务,支持 HTTP CONNECT 代理隧道
  • 对输入做前置校验:文本长度 ≤5000 字符、音频 ≤25MB,输出文件重名自动加序号

适合什么时候用

  • 希望 agent 具备语音播报能力,把回复内容念出来,如生成早报语音
  • 需要把会议录音、语音消息等音频文件转写成文字供 agent 处理
  • 希望语音合成完全免费、无使用量限制的场景

安装后会多出什么

Agent 工具voice_ttsvoice_sttvoice_list

使用前需要

  • voice_stt 需要 ASR 服务的 API Key(如 Groq / OpenAI),可通过环境变量 DSH_VOICE_ASR_KEY 或配置项 asrApiKey 设置
  • voice_tts 无需任何密钥或配置即可使用
  • 如访问 ASR 接口需要特殊网络环境,可选配置 proxyUrl 走 HTTP 代理

在 GitHub 阅读完整 README

权限与能力

安装后它能碰到什么
不覆盖任何 dsh-base 宿主行:不接管沙箱、审批、凭据等能力。
宿主能力
凭据环境变量文件系统外部网络宿主子进程
能力是范围不是结论:很多能力是功能所需。

基本信息

仓库STARDUSTLC666/dsh-voicenpmdsh-voice@0.1.1安装方式npm 预构建包收录日期2026-08-15固定 commit109bc83fce98 · 2026-08-18
dsh plugin --profile web add dsh-voice