dsh-deepseek-vision

@siegfly · 视觉与多模态
检测未发现问题无安装脚本来源一致

给纯文本 DeepSeek 模型加装的视觉网关插件,图片先由可配置 VL 模型描述成文字再发送。

v0.1.5版本
npm 预构建包安装方式
2026-08-21最近更新
7 · 2,087Star · 周下载
dsh plugin --profile web add dsh-deepseek-vision查看仓库

插件介绍

根据仓库资料整理 · commit 3527812

主要功能

  • 注册独立的 deepseek-vision provider 路由,声明支持图片输入,覆盖聊天贴图、read_image、浏览器截图、MCP/ACP 返回的图片。
  • 图片先由可配置的 VL 模型(默认 qwen3-vl-flash/Qwen-VL)逐字描述成文字,再交给 DeepSeek 继续处理。
  • 按 attachmentId 做进程内 LRU 缓存,重试、上下文压缩、多轮对话复用同一份描述,避免重复计费。
  • 原始图片仍完整持久化进 session log,历史记录、回放与上下文重构不受影响。
  • 不注入任何 agent 工具、不经过第三方中转、不依赖本地模型,图片只经过用户自行配置的 VL 端点。
  • VL 端点、模型、提示词、密钥、超时、缓存容量及失败策略(fail/placeholder)均可在设置卡片、Web Models 页或 settings.yaml 中配置。

适合什么时候用

  • 想在 DeepSeek 编程对话中直接贴图(截图、报错日志、UI 界面)但 DeepSeek 本身不支持图片输入。
  • 希望用自己信任的 VL 服务(DashScope、vLLM、OpenRouter、LM Studio 等)处理图片,而不经过任何第三方中转。
  • 希望在不改变 agent 工具集、不引入本地视觉模型依赖的前提下,给 DSH 增加图片理解能力。

安装后会多出什么

界面设置 → 插件 → 插件配置 中的“DeepSeek + Vision(视觉语言桥接)”配置卡片 · Web Models 页新增可选的“DeepSeek + Vision”provider 条目

使用前需要

  • 需要 DeepSeek API Key(默认环境变量 DEEPSEEK_API_KEY,或通过 credentials 服务解析)
  • 需要 VL 模型 API Key(默认 DashScope,环境变量 QWEN_VL_API_KEY),可替换为任意 OpenAI 兼容 /chat/completions 端点
  • 需要已安装并至少启动过一次的官方 dsh CLI(@deepseek-ai/dsh)
  • Node.js 版本需为 ^22.19 或 >=24
  • 依赖一系列官方 DSH 核心包作为 peerDependencies(如 dsh-llm-deepseek、dsh-credentials、dsh-attachment 等)

在 GitHub 阅读完整 README

权限与能力

安装后它能碰到什么
不覆盖任何 dsh-base 宿主行:不接管沙箱、审批、凭据等能力。
宿主能力
Agent 控制浏览器 UI凭据环境变量文件系统外部网络宿主子进程
能力是范围不是结论:很多能力是功能所需。

基本信息

仓库siegfly/dsh-deepseek-visionnpmdsh-deepseek-vision@0.1.5安装方式npm 预构建包收录日期2026-08-15固定 commit3527812e8a47 · 2026-08-21
dsh plugin --profile web add dsh-deepseek-vision