Token导航 LogoToken导航TokenDH.com
MCP Universal Crawler logo
运维云端stdio官方级别未说明来源级核验

MCP Universal Crawler

MCP Server

MCP服务器,将Futurepedia爬取逻辑作为工具暴露给助手使用,用于获取随机AI工具信息及通用网页爬取。

工具数

7

提示词数

0

GitHub Stars

0

资源数

0
多格式支持Python批量处理

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

作者 / 组织

litvan007

提供方

litvan007

最后核验

2026/5/17 20:21

运行时

Python

快速接入

先看主来源和安装命令,再打开仓库或文档;下面只保留这个条目的关键接入事实。

命令预览

python -m venv .venv

详细介绍

mcp通用爬虫

MCP服务器,将Futuremedia爬行逻辑作为助手的工具公开。

它的作用

  • 从Futurepedia搜索API获取随机人工智能工具
  • 打开工具详细信息页面
  • 提取结构化字段(描述、是什么、关键特征、优缺点、用户、图像)
  • 返回干净的JSON供下游助手使用

MCP工具

未来媒体特定:

  • futurepedia_random_tool() --获取一个带有解析元数据的随机工具
  • futurepedia_tools(count=3) --在一次调用中获取多个随机工具

通用爬虫:

  • crawl_url(url, timeout_sec=30) --解析通用网页(文本+标题+链接)
  • crawl_many(urls, timeout_sec=30) --批量抓取最多20个URL
  • crawl_sitemap(sitemap_url, limit=20, timeout_sec=30) --从sitemap.xml中提取URL
  • crawl_file(source, timeout_sec=30) --解析本地/远程txt/md/html/pdf/docx
  • extract_structured(url, schema_json, timeout_sec=30) --按模式提取CSS选择器

快速开始

python -m venv .venv
source .venv/bin/activate
pip install -e .
python -m universal_crawler_mcp.server

服务器通过stdio(默认MCP模式)运行。

克劳德桌面/MCP客户端配置

{
  "mcpServers": {
    "universal-crawler": {
      "command": "python",
      "args": ["-m", "universal_crawler_mcp.server"],
      "cwd": "/absolute/path/to/mcp-universal-crawler"
    }
  }
}

环境

可选:

  • PROXY_URL --用于HTTP请求的代理URL

备注

爬虫逻辑改编自 litvan007/AI-slop-tg (src/futurepedia.py)并包装以供MCP使用。

目录标签

目录标签

多格式支持Python批量处理AI工具爬取本地部署网页解析结构化数据提取

接入字段

传输方式(transport,传输协议)

stdio

鉴权方式(authType,认证方式)

none

运行时(runtime,运行环境)

Python

工具数量(toolCount,工具数)

7

资源数量(resourceCount,资源数)

0

提示词数量(promptCount,提示词数)

0

权限和风险

stdionone部署方式未说明

接入前请确认传输方式、认证方式和部署位置,并根据实际工具能力限制访问范围。

安装前确认

不要直接授予不必要的文件、网络或账号权限;先核对安装命令和配置内容。

来源信息

继续浏览同类 MCP