@maxwell-feng/dsh-windows-ocr

@maxwell-feng · 视觉与多模态
检测未发现问题无安装脚本来源一致

为纯文本模型提供本地 Windows OCR,让附加图片自动转成文字后再发送,图片本身不出本机。

v0.2.4版本
npm 预构建包安装方式
2026-08-20最近更新
6 · 492Star · 周下载
dsh plugin --profile web add @maxwell-feng/dsh-windows-ocr查看仓库

插件介绍

根据仓库资料整理 · commit 71ce320

主要功能

  • 使用系统内置 Windows.Media.Ocr 引擎在本地识别附加图片中的文字。
  • 默认只把识别出的文字发送给模型 API,图片字节不进入请求。
  • 无需修改模型配置或在 settings.yaml 中做 image 输入类型的特殊设置即可让文本模型接收图片。
  • 支持通过 passthrough 配置项手动开启,让真正的视觉模型接收原始图片。
  • 若插件未加载则采用失败关闭策略,图片附件会被拒绝而不是静默泄露。

适合什么时候用

  • 希望在不更换视觉模型、不改动模型配置的情况下,让当前使用的纯文本模型也能处理截图或图片附件。
  • 对隐私敏感,不希望图片原始字节被发送给第三方模型提供商,只想让模型看到文字内容。

使用前需要

  • 运行环境为 Windows 10/11,自带 Windows PowerShell 5.1+。
  • 需要为所需语言安装支持 OCR 的 Windows 语言包(如中文需额外安装对应语言包)。
  • 需要 dsh 并配置对应 profile(README 测试环境为 dsh 0.1.0-rc.8)。

在 GitHub 阅读完整 README

权限与能力

安装后它能碰到什么
不覆盖任何 dsh-base 宿主行:不接管沙箱、审批、凭据等能力。
宿主能力
文件系统宿主子进程
能力是范围不是结论:很多能力是功能所需。

基本信息

仓库maxwell-feng/dsh-windows-ocrnpm@maxwell-feng/dsh-windows-ocr@0.2.5安装方式npm 预构建包收录日期2026-08-17固定 commit71ce320facf0 · 2026-08-20
dsh plugin --profile web add @maxwell-feng/dsh-windows-ocr