Token导航 LogoToken导航TokenDH.com
Markudown MCP logo
浏览器工具未说明官方级别未说明来源级核验

Markudown MCP

MCP Server

为AI代理提供网页抓取、Google搜索和数据提取功能的API服务,无需自建基础设施。

工具数

10

提示词数

0

GitHub Stars

10

资源数

0
浏览器自动化数据提取TypeScriptClaudeClaude DesktopClaudeCursorWindsurf

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

作者 / 组织

Scrape-Technology

提供方

Scrape-Technology

最后核验

2026/5/17 20:19

快速接入

先看主来源和安装命令,再打开仓库或文档;下面只保留这个条目的关键接入事实。

详细介绍

markudown mcp

MCP服务器 MarkU自有/报废技术 --允许AI代理(Claude、Cursor、Windsurf、n8n、LangGraph等)访问网络抓取、谷歌搜索、数据提取等。

不需要基础设施。 只是一个API密钥。

______________________________________________________________________

运作原理

AI Agent (Claude Desktop, Cursor, etc.)
        │  MCP protocol (stdio)
        ▼
  markudown-mcp  (this package)
        │  HTTPS + polling
        ▼
  api.scrapetechnology.com
        │  BullMQ jobs
        ▼
  MarkUDown Engine workers

______________________________________________________________________

快速开始

MARKUDOWN_API_KEY=your-key npx markudown-mcp

获取API密钥: scrapetechnology.com.

______________________________________________________________________

克劳德桌面

添加 claude_desktop_config.json:

  • macOS: ~/Library/Application Support/Claude/claude_desktop_config.json
  • 视窗: %APPDATA%\Claude\claude_desktop_config.json
{
  "mcpServers": {
    "markudown": {
      "command": "npx",
      "args": ["markudown-mcp"],
      "env": {
        "MARKUDOWN_API_KEY": "your-api-key-here"
      }
    }
  }
}

保存后重新启动Claude Desktop。

______________________________________________________________________

光标/风帆

添加到编辑器的MCP配置中:

{
  "markudown": {
    "command": "npx",
    "args": ["markudown-mcp"],
    "env": {
      "MARKUDOWN_API_KEY": "your-api-key-here"
    }
  }
}

______________________________________________________________________

环境变量

变量必填默认描述
MARKUDOWN_API_KEY-您的Scrape Technology API密钥
MARKUDOWN_API_URL没有https://api.scrapetechnology.com覆盖API基本URL(自托管部署)

______________________________________________________________________

可用工具

scrape

删除一个URL,并将其内容作为干净的Markdown返回。

参数类型默认值说明
urlstring必需要抓取的URL
mainContent布尔值true条形导航、广告和侧边栏
includeLinks布尔值false在输出中包含超链接
includeHtml布尔值false同时返回原始HTML
excludeTagsstring\[\]["header","nav","footer"]要删除的HTML标签
timeout编号60超时时间(秒)

示例提示: *“刮擦https://example.com并总结了主要内容。"*

______________________________________________________________________

map

通过站点地图解析和链接爬行发现网站上的所有网址。

参数类型默认值说明
urlstring必填网站的根URL
maxUrls编号1000要返回的最大URL数
allowedWordsstring\[\][]仅包含包含这些单词的URL
blockedWordsstring\[\][]排除包含这些单词的URL

示例提示: *“映射docs.example.com上的所有URL。”*

______________________________________________________________________

crawl

根据内部链接递归抓取网站。返回每个页面的Markdown。

参数类型默认值说明
urlstring必需起始URL
maxDepth编号2最大链接深度
limit编号10可抓取的最大页面数
mainContent布尔值true仅提取主要内容
includeLinks布尔值false包含超链接
includeHtml布尔值false包含原始HTML
excludeTagsstring\[\]--要删除的HTML标签
blockedWordsstring\[\]--跳过包含这些单词的URL
includeOnlystring\[\]--仅抓取包含这些单词的URL
timeout编号60每页超时时间(秒)

示例提示: *“爬行https://docs.example.com深入到深度3,找到所有提到“身份验证”的地方。"*

______________________________________________________________________

search

运行谷歌搜索,并可选择抓取每个结果页面的完整内容。

参数类型默认值说明
querystring必填搜索查询
limit编号5结果数量
scrapeResults布尔值true为每个结果删除全部内容
lang字符串"en"语言代码
country字符串"us"国家代码
timeout编号60每页超时时间(秒)

示例提示: *“搜索‘2025年最佳网络抓取库’,并总结前5个结果。”*

______________________________________________________________________

extract

使用自然语言提示抓取URL并提取结构化数据。

参数类型默认值说明
urlstring必需要从中提取的URL
promptstringrequired要提取什么,例如。 "All product names and prices"
timeout编号60超时时间(秒)

示例提示: *“从以下位置提取所有工作列表https://jobs.example.com包括职位、地点和工资。"*

______________________________________________________________________

batch_scrape

并行删除多个URL。为每个对象返回Markdown。

参数类型默认值说明
urlsstring\[\]必需要抓取的URL(至少1个)
timeout编号60每页超时时间(秒)

示例提示: *“删除这5个竞争对手的定价页面,并比较他们的计划。”*

______________________________________________________________________

screenshot

对URL进行全屏截图。

参数类型默认值说明
urlstring必填截图URL
timeout编号60导航超时(秒)

示例提示: *“截图https://example.com."*

______________________________________________________________________

deep_research

使用LLM抓取多个URL并将其内容合成为一份全面的研究报告。

参数类型默认值说明
querystring必填研究问题或主题
urlsstring\[\]必填要抓取的源URL(至少1个)
maxTokens编号4096报告的最大令牌数
timeout编号180超时时间(秒)

示例提示: *“研究这3家SaaS公司的定价策略,并撰写比较分析。”*

______________________________________________________________________

agent

启动一个人工智能代理,自动导航网站以回答问题或完成任务。

参数类型默认值说明
urlstring必需起始URL
promptstring必填代理的任务或问题
maxSteps编号10最大导航步数
maxPages编号5可访问的最大页面数
allowNavigation布尔值true允许以下链接
includeScreenshots布尔值false每一步截图
timeout编号120总超时时间(秒)

示例提示: *首选https://shop.example.com并找到退货政策。"*

______________________________________________________________________

change_detection

检测URL的内容自上次检查以来是否已更改。

参数类型默认值说明
urlstring必需要监视的URL
mainContent布尔值true仅比较主要内容
excludeTagsstring\[\]["header","nav","footer"]比较时要忽略的标签
timeout编号60超时时间(秒)

示例提示: *“检查定价页面是否位于https://example.com/pricing已经改变了。"*

______________________________________________________________________

自托管部署

如果您运行自己的MarkUDown引擎,请设置 MARKUDOWN_API_URL 指向您的实例:

{
  "mcpServers": {
    "markudown": {
      "command": "npx",
      "args": ["markudown-mcp"],
      "env": {
        "MARKUDOWN_API_KEY": "your-api-key",
        "MARKUDOWN_API_URL": "https://your-engine.example.com"
      }
    }
  }
}

对于直接的BullMQ访问(不需要API密钥),请使用 自托管MCP服务器MarkUDown-Engine/services/mcp/.

______________________________________________________________________

支持与社区

许可证

麻省理工学院

目录标签

目录标签

浏览器自动化数据提取TypeScriptClaude网页抓取本地部署AI代理搜索引擎集成自动化工具

支持客户端

Claude DesktopClaudeCursorWindsurf

接入字段

传输方式(transport,传输协议)

未说明

鉴权方式(authType,认证方式)

none

工具数量(toolCount,工具数)

10

资源数量(resourceCount,资源数)

0

提示词数量(promptCount,提示词数)

0

权限和风险

未说明none部署方式未说明

接入前请确认传输方式、认证方式和部署位置,并根据实际工具能力限制访问范围。

安装前确认

不要直接授予不必要的文件、网络或账号权限;先核对安装命令和配置内容。

仍需确认:installCommand

来源信息

继续浏览同类 MCP