@liustack/modlens

@liustack · 视觉与多模态
检测未发现问题无安装脚本来源一致

让纯文本 DeepSeek/GLM 模型读懂粘贴的图片,输出结构化 OCR/版面/语义证据

v3.24.0版本
npm 预构建包安装方式
2026-08-22最近更新
3,498 · 75.8kStar · 周下载
dsh plugin --profile web add @liustack/modlens查看仓库

插件介绍

根据仓库资料整理 · commit 99eb92f

主要功能

  • 粘贴图片自动转为结构化 JSON 证据,包括全文转写、按阅读顺序的版面区域、实体与关系列表
  • 自动发现所有纯文本 DeepSeek/GLM 供应商路由,在模型选择器中生成对应的 (modlens vision) 包装条目,原生视觉模型不受影响
  • 零配置启动,可复用 Claude Code、Codex、OpenCode、Pi 等已有登录,或通过免费 Antigravity CLI / 免费 Gemini API Key 获取视觉引擎
  • 支持以逗号分隔配置多个 API Key,在鉴权失败、限流或配额耗尽时自动轮换
  • 不使用 hook、包装器或本地代理进程,不改动任何 harness 配置文件,卸载即删除插件文件夹
  • DSH 设置页新增 ModLens 卡片,可切换视觉引擎、勾选允许自动复用的本地 CLI

适合什么时候用

  • 使用纯文本 DeepSeek 或 GLM 模型的 DSH 用户,希望在对话中直接粘贴截图或图片让模型理解
  • 需要从图片中提取结构化文本、版面信息或实体关系,供后续任务使用
  • 希望零成本或低成本为文本模型加装视觉能力,复用已有 CLI 登录而无需额外改动 harness 配置

安装后会多出什么

界面Settings → Plugins → Plugin config 中的 ModLens 卡片,可切换视觉引擎、勾选本地 CLI 复用 · 模型选择器中新增的 (modlens vision) 包装模型条目
Agent 工具modlens_read_image

使用前需要

  • 需运行在 DeepSeek Harness (dsh) 环境中
  • 需要 Node.js 运行环境
  • 需要至少一个可用的视觉引擎来源:复用 Claude Code/Codex/OpenCode/Pi 已有登录,或配置 Antigravity CLI 登录、免费 Gemini API Key,或其他 OpenAI 兼容 API Key

在 GitHub 阅读完整 README

权限与能力

安装后它能碰到什么
不覆盖任何 dsh-base 宿主行:不接管沙箱、审批、凭据等能力。
宿主能力
Agent 控制浏览器 UI凭据环境变量文件系统外部网络宿主子进程
能力是范围不是结论:很多能力是功能所需。

基本信息

仓库liustack/modlensnpm@liustack/modlens@3.22.1安装方式npm 预构建包收录日期2026-08-14固定 commit99eb92f0340c · 2026-08-22
dsh plugin --profile web add @liustack/modlens