Token导航 LogoToken导航TokenDH.com
Doc Scraper MCP Server logo
文档知识stdio官方级别未说明来源级核验

Doc Scraper MCP Server

MCP Server

@smithery/cli

一个基于Model Context Protocol (MCP)的服务器,提供将网页文档转换为Markdown格式的功能。

工具数

1

提示词数

0

GitHub Stars

8

资源数

0
文档转换浏览器自动化PythonClaudeClaude DesktopClaude

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

作者 / 组织

askjohngeorge

提供方

askjohngeorge

最后核验

2026/5/17 20:19

运行时

Node.js

快速接入

先看主来源和安装命令,再打开仓库或文档;下面只保留这个条目的关键接入事实。

命令预览

npx -y @smithery/cli install @askjohngeorge/mcp-doc-scraper --client claude

详细介绍

](https://mseep.ai/app/askjohngeorge-mcp-doc-scraper)

文档刮刀MCP服务器

](https://smithery.ai/server/@askjohngeorge/mcp-doc-scraper)

提供文档抓取功能的模型上下文协议(MCP)服务器。此服务器使用jina.ai的转换服务将基于web的文档转换为markdown格式。

特性

  • 从任何web URL中删除文档
  • 将HTML文档转换为markdown格式
  • 将转换后的文档保存到指定的输出路径
  • 与模型上下文协议(MCP)集成

安装

通过Smithery安装

通过以下方式自动安装Claude Desktop的Doc Scraper 史密瑟里:

npx -y @smithery/cli install @askjohngeorge/mcp-doc-scraper --client claude
  1. 克隆存储库:
git clone https://github.com/askjohngeorge/mcp-doc-scraper.git
cd mcp-doc-scraper
  1. 创建并激活虚拟环境:
python -m venv venv
source venv/bin/activate  # On Windows, use: venv\Scripts\activate
  1. 安装依赖项:
pip install -e .

用法

服务器可以使用Python运行:

python -m mcp_doc_scraper

工具说明

服务器提供了一个工具:

  • 名字: scrape_docs
  • 描述:从URL中删除文档并另存为markdown
  • 输入参数:

- url:要抓取的文档的URL - output_path:应保存markdown文件的路径

项目结构

doc_scraper/
├── __init__.py
├── __main__.py
└── server.py

依赖项

  • 意图tp
  • 主控程序
  • 媒染剂

发展

设置开发环境:

  1. 安装开发依赖项:
pip install -r requirements.txt
  1. 服务器使用模型上下文协议。一定要熟悉 MCP文件.

许可证

MIT许可证

目录标签

目录标签

文档转换浏览器自动化PythonClaude本地部署网页抓取Markdown生成MCP集成

支持客户端

Claude DesktopClaude

接入字段

传输方式(transport,传输协议)

stdio

鉴权方式(authType,认证方式)

none

运行时(runtime,运行环境)

Node.js

来源包(packageName,安装包名)

@smithery/cli

工具数量(toolCount,工具数)

1

资源数量(resourceCount,资源数)

0

提示词数量(promptCount,提示词数)

0

权限和风险

stdionone部署方式未说明

接入前请确认传输方式、认证方式和部署位置,并根据实际工具能力限制访问范围。

安装前确认

不要直接授予不必要的文件、网络或账号权限;先核对安装命令和配置内容。

来源信息

继续浏览同类 MCP