Web-curl 是一个强大的网页爬取工具,支持通过 Puppeteer 进行浏览器自动化、内容提取和 Google 自定义搜索,适用于数据抓取和研究自动化。
工具数量
7
GitHub Stars
10
Web-curl 是一个强大的网页爬取工具,支持通过 Puppeteer 进行浏览器自动化、内容提取和 Google 自定义搜索,适用于数据抓取和研究自动化。
工具数量
7
GitHub Stars
10
Docs Fetch MCP Server是一款用于抓取和递归探索网页内容的服务器,特别适用于LLM自主学习和获取特定主题的文档或网页内容。
工具数量
1
GitHub Stars
7
一个轻量级的MCP服务器,用于LLM编排,提供高效的网页内容搜索和提取功能。
安装状态
已补齐
工具数量
0
GitHub Stars
7
命令预览
Python is an easy to learn, powerful programming language...
MCP文档解析工具,支持多种文件格式(PDF、Word、Excel、PPT等)的内容提取和转换。
工具数量
1
GitHub Stars
7

mcp-fetch-node
A Model Context Protocol server that provides web content fetching capabilities.
安装状态
已补齐
工具数量
1
GitHub Stars
7
命令预览
npx -y mcp-fetch-node
MCP Web Search是一个本地优先的网页搜索和URL资源加载工具,支持多提供商搜索和URL内容提取,无需API密钥。
工具数量
2
GitHub Stars
5
一个与Agent.ai API集成的MCP服务器,提供网页文本提取、网页截图和YouTube转录功能,通过动态函数加载系统实现。
安装状态
已补齐
工具数量
3
GitHub Stars
4
命令预览
NPX 配置
一个基于Python的MCP网页爬虫工具,用于提取和保存网站内容,支持批量处理和可配置的输出目录。
安装状态
已补齐
工具数量
0
GitHub Stars
4
命令预览
pip install -r requirements.txt
一个基于Python和FastMCP的Mozilla Readability解析器服务器,用于提取和转换网页内容为干净的、适合LLM处理的Markdown格式。
安装状态
已补齐
工具数量
0
GitHub Stars
4
命令预览
python -m venv venv
Agent Scraper MCP Server是一款专业的网页抓取工具,提供网页内容提取、结构化数据抓取、截图等功能,适用于AI代理和自动化任务。
安装状态
已补齐
工具数量
6
GitHub Stars
3
命令预览
pip install -e ".[dev]"
DocNav是一个模型上下文协议(MCP)服务器,赋能LLM代理智能阅读、分析和管理长文档,模拟人类的理解和导航能力。
安装状态
已补齐
工具数量
8
GitHub Stars
3
命令预览
uv run server.py

mcp-server-scraper
一个无需API密钥的免费工具,用于从URL中提取干净的Markdown文本、链接和元数据,适用于文档、博客和文章的抓取。
安装状态
已补齐
工具数量
5
GitHub Stars
3
命令预览
npx mcp-server-scraper
一个实验性的MCP服务器,可将YouTube播放列表的转录文本提供使用,适用于需要快速获取视频内容转录的场景。
安装状态
已补齐
工具数量
0
GitHub Stars
3
命令预览
uv run server.py https://www.youtube.com/playlist?list=PLj6h78yzYM2MP0QhYFK8HOb8UqgbIkLMc
一个移除robots.txt检查的模型上下文协议服务器,提供网页内容抓取功能,将HTML转换为Markdown以便于处理。
安装状态
已补齐
工具数量
0
GitHub Stars
2
命令预览
uv run python -m mcp_fetch --help
一个提供网页搜索和内容提取功能的模型上下文协议服务器,使用Google Custom Search API进行网络搜索,并能从网页中提取结构化内容。
工具数量
0
GitHub Stars
2
一个基于Tavily搜索API的AI驱动网络搜索服务,支持HTTP/HTTPS代理配置,适用于需要通过代理服务器进行复杂网络搜索的场景。
安装状态
已补齐
工具数量
3
GitHub Stars
2
命令预览
pip install mcp-tavily-proxy
MCP WebScout是一个提供DuckDuckGo网络搜索和基于LLM的智能内容提取的服务,适用于需要高级网络数据抓取和分析的场景。
安装状态
已补齐
工具数量
2
GitHub Stars
2
命令预览
python -m venv .venv

@smithery/cli
一个强大的MCP服务器,提供网络搜索和相似内容查找功能,适用于需要网络搜索能力或基于查询查找相似内容的应用和项目。
安装状态
已补齐
工具数量
0
GitHub Stars
2
命令预览
npx -y @smithery/cli install @DeepSpringAI/parquet_mcp_server --client claude
Enhanced Fetch MCP是一个AI原生的网页交互层,将Playwright提升为智能、安全且高效的服务,适用于AI代理,提供内容提取、浏览器自动化、安全沙箱等功能。
工具数量
0
GitHub Stars
1

playwright
MCP服务器通过Playwright从网页中提取干净的Markdown内容,适用于文档整理、内容分析和AI集成等场景。
安装状态
已补齐
工具数量
1
GitHub Stars
1
命令预览
npx playwright install chromium