Harness Trust
插件商店
检查已安装插件
搜索插件、npm 包名或仓库
EN
首页
/
插件商店
/
视觉与多模态
/
@linxin666/dsh-tool-describe-image
@linxin666/dsh-tool-describe-image
@DamonKoy · packages/dsh-tool-describe-image · 视觉与多模态
检测未发现问题
无安装脚本
为纯文本模型提供 describe_image 工具,借助视觉语言模型理解图片内容
v0.1.16
版本
GitHub 源码安装
安装方式
2026-08-15
最近更新
4
Star
复制安装命令
dsh plugin --profile web add github:DamonKoy/dsh-web-ui#path:/packages/dsh-tool-describe-image
查看仓库
插件介绍
根据仓库资料整理 · commit 3647a33
主要功能
提供 describe_image 工具,让纯文本模型通过视觉语言模型获得图像理解能力
支持三种图片输入:本地绝对路径、http(s) URL、会话内附件引用(拖拽/粘贴生成)
拖拽或粘贴图片会自动重写为 describe-image 引用,图片可在对话中渲染,但仅文本结果进入模型上下文
通过 prompt 参数自定义指令,支持 OCR、图表提取、UI 诊断、翻译等具体任务
设置页提供"Image understanding"配置卡片,可实时修改 baseURL/apiStyle/model/API key/默认指令,无需重启
兼容 chat-completions 与 responses 两种 OpenAI 兼容协议风格
适合什么时候用
使用纯文本大模型(如 DeepSeek V4)但需要理解截图、照片或图表内容时
需要对图片进行 OCR 文字提取、表格转 CSV 或翻译等结构化处理时
需要针对 UI 截图进行界面走查或问题诊断时
安装后会多出什么
界面
设置 → 插件配置 → Web UI Plugins 下的 "Image understanding" 配置卡片
Agent 工具
describe_image
使用前需要
需要一个 OpenAI 兼容的视觉模型服务端点(如 Qwen-VL、GLM-4V、GPT-4o 或本地 Ollama)
需要配置 API Key(默认读取环境变量 VISION_API_KEY,或在配置中内联指定)
需要在插件配置中设置必填项 baseURL 与 model,否则首次调用会报错
在 GitHub 阅读完整 README
权限与能力
安装后它能碰到什么
不覆盖任何 dsh-base 宿主行:不接管沙箱、审批、凭据等能力。
宿主能力
Agent 控制
浏览器 UI
凭据
环境变量
文件系统
外部网络
宿主子进程
能力是范围不是结论:很多能力是功能所需。
基本信息
仓库
DamonKoy/dsh-web-ui/packages/dsh-tool-describe-image
安装方式
GitHub 源码安装(需 allowBuilds)
安装提示
源码安装会在你的机器上执行 prepare 构建,需要 allowBuilds 授权;建议用 github:DamonKoy/dsh-web-ui#3647a33 锁定本次检测的 commit。
收录日期
2026-08-17
固定 commit
3647a33fa467
· 2026-08-15
dsh plugin --profile web add github:DamonKoy/dsh-web-ui#path:/packages/dsh-tool-describe-image
复制
@linxin666/dsh-tool-describe-image — DeepSeek Harness 插件商店 · Harness Trust