dsh-voice-call

@PandaPolo · 语音与音频
检测未发现问题无安装脚本来源一致

让 DSH agent 主动语音打电话给你,本地合成播放,接听权始终在人类手里

v0.1.0版本
npm 预构建包安装方式
2026-08-17最近更新
2 · 295Star · 周下载
dsh plugin --profile web add dsh-voice-call查看仓库

插件介绍

根据仓库资料整理 · commit 271b0fa

主要功能

  • offer_call 工具触发振铃,人类可选择接听、拒接或稍后再说,接听后台合成语音并本地播放,拒接/推迟结果会返回给 agent
  • speak 工具可直接朗读文本,真实调用本地播放器(Windows PowerShell SoundPlayer、macOS afplay、Linux aplay)
  • transcribe 工具将语音转成文字消息,支持 whisper-local/openai/macOS 原生等后端,可选跨会话投递
  • /voice 斜杠命令可查看语音状态、开关朗读回复、直接说出指定文本
  • 内置 9 种 CustomVoice 音色,含 2 种中文方言(北京话、四川话)
  • 本地优先运行,基于 CrispASR 引擎与 Qwen3-TTS GGUF 模型合成,可完全离线,任何音频行为均需模型主动调用工具或人类接听触发

适合什么时候用

  • 希望 agent 在完成任务或达到里程碑时主动语音通知你,由你决定是否接听
  • 需要在会话中把语音输入转成文字消息,或让 agent 朗读回复内容
  • 希望在完全离线、本地环境下使用中文方言等多音色 TTS/STT 能力

安装后会多出什么

界面来电弹窗(接听/拒接/稍后再说)
命令/voice
Agent 工具offer_callspeaktranscribe

使用前需要

  • Node.js ≥ 20(运行测试需 22.18+)
  • dsh CLI(@deepseek-ai/dsh),当前版本 0.1.0-rc.6
  • 本地语音引擎 CrispASR ≥ 0.8.28,及 Qwen3-TTS GGUF 模型(talker + codec)
  • 已配置可用的 LLM API 凭据(dsh agent 运行所需)
  • 需在 profile 的 cordis.patch.yml 中按 id 手动配置 tts/stt/callMode 等字段,且 durableEvents 在 rc.6 下须保持 false

在 GitHub 阅读完整 README

权限与能力

安装后它能碰到什么
不覆盖任何 dsh-base 宿主行:不接管沙箱、审批、凭据等能力。
宿主能力
Agent 控制浏览器 UI凭据环境变量文件系统外部网络会话数据宿主子进程
能力是范围不是结论:很多能力是功能所需。

基本信息

仓库PandaPolo/dsh-voice-callnpmdsh-voice-call@0.1.0安装方式npm 预构建包收录日期2026-08-16固定 commit271b0fab9dab · 2026-08-17
dsh plugin --profile web add dsh-voice-call