dsh-scrape-webpage

@131CDA1 · 浏览器与网页
检测未发现问题无安装脚本来源一致

抓取并分析任意网页内容,提取正文、结构与关键词,支持下载图片供视觉模型识别。

v1.0.0版本
npm 预构建包安装方式
2026-08-20最近更新
7 · 0Star · 周下载
dsh plugin --profile web add dsh-scrape-webpage查看仓库

插件介绍

根据仓库资料整理 · commit 7485af1

主要功能

  • 抓取 http/https 网页,自动处理重定向与非 2xx 状态码
  • 提取标题、页面描述、正文、H1–H6 标题结构与最多 100 条链接
  • 自动统计字符数/词数、预计阅读时长、语言倾向,并生成 Top30 高频关键词
  • 可选下载页面内容图片至会话工作区,供视觉模型直接查看分析
  • 发布 scrape.imageAnalyzer 服务,供已注册的识图插件自动分析抓取到的图片
  • 默认沙箱内运行,HTTPS 受限时可显式申请一次性升级权限重试

适合什么时候用

  • 需要让 Agent 快速摘要或分析某个网页内容时
  • 需要提取网页结构(标题、链接)或做关键词/阅读时长统计时
  • 需要下载网页图片并交给视觉模型或识图插件分析时

安装后会多出什么

Agent 工具scrape_webpage

使用前需要

  • 需要 pnpm 在 PATH 中以支持 dsh plugin 安装流程
  • 依赖宿主的 tools、systemPrompt、timer 服务(硬依赖)
  • 可选依赖 web、shell、sandboxPolicy、approval、sessions 服务,缺失时优雅降级
  • 若部署无 web fetch provider,会回退使用 curl.exe(Windows 10 1803+ 自带,其他平台需 PATH 中有 curl)

在 GitHub 阅读完整 README

权限与能力

安装后它能碰到什么
不覆盖任何 dsh-base 宿主行:不接管沙箱、审批、凭据等能力。
宿主能力
Agent 控制外部网络宿主子进程
能力是范围不是结论:很多能力是功能所需。

基本信息

仓库131CDA1/dsh-scrape-webpagenpmdsh-scrape-webpage@1.0.0安装方式npm 预构建包收录日期2026-08-19固定 commit7485af10c063 · 2026-08-20
dsh plugin --profile web add dsh-scrape-webpage