Token导航 LogoToken导航TokenDH.com
Cloudscraper MCP Server logo
AI代理stdio官方级别未说明来源级核验

Cloudscraper MCP Server

MCP Server

CloudScraper MCP Server是一个模型上下文协议服务器,使AI代理能够绕过Cloudflare保护并爬取网页内容,支持多种传输协议和内容清洗功能。

工具数

3

提示词数

0

GitHub Stars

1

资源数

0
网页爬取PythonClaudeAI代理Claude

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

作者 / 组织

LLMTooling

提供方

LLMTooling

最后核验

2026/5/17 20:22

运行时

Python

快速接入

先看主来源和安装命令,再打开仓库或文档;下面只保留这个条目的关键接入事实。

命令预览

uv run server.py

详细介绍

CloudScraper MCP服务器

模型上下文协议服务器,使AI代理能够绕过Cloudflare保护并抓取web内容

](https://www.python.org/downloads/) ![FastMCP](https://github.com/jlowin/fastmcp) ![Tests](tests/) ![License](LICENSE) ](DOCKER.md)

______________________________________________________________________

核心功能

特性描述
Cloudflare旁路使用cloudscraper库自动处理Cloudflare保护
多个传输支持stdio和HTTP传输协议
内容物清理将HTML转换为干净、LLM友好的Markdown格式
智能分块自动将大型响应拆分为10k个令牌块
Docker支持生产就绪的集装箱化部署
多种方法支持GET和POST HTTP方法
二进制处理非文本内容的Base64编码
文件导出将抓取的内容直接保存到磁盘

______________________________________________________________________

可用的MCP工具

工具比较

工具返回类型用例分块支持文件输出
scrape_url字符串(仅内容)用于AI处理的快速内容检索
scrape_url_raw字典(元数据+内容)包含标题和时间的完整响应详细信息
scrap_url_to_file词典(保存确认)将内容导出到工作区文件

______________________________________________________________________

共享参数

参数类型必填默认说明
urlstring-要抓取的目标URL
methodstring“GET”HTTP方法(GET或POST)
clean_contentbooleantrue将HTML转换为Markdown
continuation_tokenstringnull用于检索下一个块的令牌

______________________________________________________________________

scrape_url响应字段

字段类型描述
响应字符串包含块指令的页面内容(如适用)

注: 当内容超过10k个令牌时,响应包括嵌入在文本中的继续指令。

______________________________________________________________________

scrape_url_raw响应字段

字段类型始终存在描述
status_codeintegerHTTP响应状态代码
headersobjectYes响应标头(逐跳标头已删除)
contentstring页面内容或当前块
content_typestring响应的MIME类型
response_timenumberYes请求持续时间(秒)
chunkedboolean分块时表示响应已拆分
chunk_indexinteger分块时当前分块编号(从1开始)
total_chunksinteger分块时分块总数
continuation_tokenstring当有更多块时下一次块检索的令牌
total_tokensinteger分块时完整响应中的令牌总数
messagestring分块时人类可读的块状态
errorstring失败时错误描述

______________________________________________________________________

scrap_url_to_file参数

参数类型必填默认说明
urlstring-要抓取的目标URL
file_pathstring-内容应保存的路径
methodstring“GET”HTTP方法(GET或POST)
clean_contentbooleanfalse保存前将HTML转换为Markdown
overwritebooleanfalse如果文件存在,则替换它

______________________________________________________________________

scrap_url_to_file响应字段

字段类型始终存在描述
status_codeintegerHTTP响应状态代码
headersobjectYes响应标头(逐跳标头已删除)
content_typestring保存内容的MIME类型
response_timenumberYes请求持续时间(秒)
file_pathstring成功时保存文件的绝对路径
bytes_writteninteger成功时写入磁盘的字节数
messagestring成功时确认消息
errorstring失败时错误描述

______________________________________________________________________

安装

先决条件

要求版本目的
Python3.10+运行时环境
uv最新依赖关系管理
Git任意存储库克隆

设置步骤

克隆存储库并安装依赖项:

git clone https://github.com/yourusername/cloudscraper-mcp-server.git
cd cloudscraper-mcp-server
uv sync

______________________________________________________________________

配置

传输协议

运输最适合配置
标准Claude Code、VSCode、直接AI集成默认模式,不需要环境变量
超文本传输协议n8n,Web应用程序,API集成,远程访问需要MCP_TRANSPORT=http

______________________________________________________________________

环境变量

变量默认值选项描述
MCP_TRANSPORTstdiostdio,http传输协议选择
MCP_HOST0.0.0.0任何有效的IPHTTP模式的主机绑定
MCP_PORT8000任何有效端口HTTP模式端口

______________________________________________________________________

用法示例

使用Stdio传输运行(默认)

uv run server.py

使用HTTP传输运行

MCP_TRANSPORT=http MCP_HOST=0.0.0.0 MCP_PORT=8000 uv run server.py

Claude代码集成

claude mcp add cloudscraper-mcp \
  --type stdio \
  --command "uv" \
  --args "run" "server.py" \
  --directory "/path/to/cloudscraper-mcp-server"

VSCode/IDE配置

{
  "mcpServers": {
    "cloudscraper-mcp": {
      "type": "stdio",
      "command": "uv",
      "args": [
        "run",
        "server.py"
      ],
      "cwd": "/path/to/cloudscraper-mcp-server"
    }
  }
}

______________________________________________________________________

Docker部署

有关容器化部署说明,请参阅 医生.md

______________________________________________________________________

技术栈

组件技术目的
协议FastMCP 3.0+模型上下文协议实现
抓取cloudscraper 1.2.71+Cloudflare旁路引擎
压缩brotli 1.0.9+响应解压缩
解析beautifulsoup4 4.10.0+HTML解析
转换markdownify 0.11.6+HTML到Markdown的转换
分词tiktoken 0.5.0+分块代币计数
测试pytest 8.0+集成测试套件

______________________________________________________________________

高级功能

响应分块系统

特征描述
每区块最大代币数10000单个响应中的最大令牌数
块过期2分钟块检索的缓存寿命
令牌编码cl100k_basetiktoken编码模型
连续模式chunk_id:索引用于顺序检索的令牌格式

______________________________________________________________________

安全标头

标题目的
用户代理Chrome 120浏览器模拟
Sec-Ch UaChrome/Chromium客户端提示
Sec Fetch-\*cors/同源获取元数据
来源/参照者自动生成请求合法性

______________________________________________________________________

采用CloudScraper和FastMCP制造

目录标签

目录标签

网页爬取PythonClaudeAI代理本地部署Cloudflare绕过内容清洗HTTP传输

支持客户端

Claude

接入字段

传输方式(transport,传输协议)

stdio

鉴权方式(authType,认证方式)

none

运行时(runtime,运行环境)

Python

工具数量(toolCount,工具数)

3

资源数量(resourceCount,资源数)

0

提示词数量(promptCount,提示词数)

0

权限和风险

stdionone部署方式未说明

接入前请确认传输方式、认证方式和部署位置,并根据实际工具能力限制访问范围。

安装前确认

不要直接授予不必要的文件、网络或账号权限;先核对安装命令和配置内容。

来源信息

继续浏览同类 MCP