Token导航 LogoToken导航TokenDH.com
运维操作浏览器clawhub未标认证来源可访问clear审计通过

cn-scrapling中文刮刮

Agent Skill

cn-scrapling 用于处理浏览器自动化、网页检查和页面信息提取,适合在 OpenClaw 中需要让 Agent 打开页面、读取网页或验证前端流程时使用。可结合来源仓库、安装命令和原始 README 继续核验具体用法。安装前建议确认权限范围、维护状态,以及是否会触发联网、命令执行或文件读写。

总安装

2,808

周安装

117

GitHub Stars

公开资料未说明

下载量

936
OpenClaw

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

GitHub

来源数

2

许可证

MIT-0

最后核验

2026-05-01

来源状态

来源可访问

安装方式

通过对话安装

复制提示词发给支持本地命令或 Skills 的 AI 助手,先确认命令和权限,再让它执行。

请帮我安装这个 Agent Skill:cn-scrapling(中文刮刮)
来源仓库:https://github.com/cn-big-cabbage/cn-scrapling
安装命令:
openclaw skills install cn-scrapling
安装前请先检查当前环境是否支持对应 CLI,并向我确认将要执行的命令、安装目录、联网范围和文件读写权限;确认后再执行。

命令行安装

复制命令到本机终端执行。该命令会通过 OpenClaw 从第三方来源获取 Skill;本站只展示命令,不托管安装包,也不自动执行。

ClawHubOpenClaw
openclaw skills install cn-scrapling

简介

高性能自适应 Python 网页抓取框架,内置反爬虫绕过(Cloudflare Turnstile)、智能元素重定位、完整爬虫框架和 MCP 服务器,适合 AI 辅助数据提取和大规模爬取任务

SKILL.md

name
scrapling
description
高性能自适应 Python 网页抓取框架,内置反爬虫绕过(Cloudflare Turnstile)、智能元素重定位、完整爬虫框架和 MCP 服务器,适合 AI 辅助数据提取和大规模爬取任务
version
0.1.0
metadata
openclaw_requires
>=1.0.0
emoji
🕷️
homepage
https://scrapling.readthedocs.io

Scrapling — 自适应网页抓取框架

Scrapling 是 Google Chrome DevTools 生态之外最强大的 Python 网页抓取框架之一,能够处理从单次 HTTP 请求到大规模并发爬取的所有场景。它的自适应解析引擎在网页改版后自动重新定位元素,内置 Cloudflare Turnstile 绕过能力,Spider 框架支持暂停/恢复,并提供 MCP 服务器让 AI 直接辅助数据提取,从源头减少 Token 消耗。

核心使用场景

  • 反爬虫网站抓取StealthyFetcher 内置 Cloudflare Turnstile 绕过,支持 TLS 指纹伪装和浏览器自动化
  • 自适应数据整理:网页改版后,auto_save=True 保存元素快照,adaptive=True 自动重新定位变化元素
  • 大规模并发爬取:Spider 框架支持多 Session、代理轮换、暂停恢复,像 Scrapy 一样定义爬虫
  • AI 辅助提取:内置 MCP 服务器,Claude/Cursor 等 AI 工具可直接调用 Scrapling 提取目标内容
  • 动态页面处理DynamicFetcher 基于 Playwright,支持完整浏览器自动化和网络空闲等待

AI 辅助使用流程

  1. 安装依赖 — AI 执行 pip install scrapling 并按需安装浏览器驱动
  2. 选择 Fetcher — AI 根据目标网站类型推荐 Fetcher/StealthyFetcher/DynamicFetcher
  3. 编写抓取逻辑 — AI 生成 CSS/XPath 选择器代码,配置 auto_save 实现自适应
  4. 调试与优化 — AI 分析响应结果,调整选择器或切换 Fetcher 策略
  5. 扩展为 Spider — AI 将单页抓取扩展为完整 Spider 类,配置并发和代理
  6. MCP 模式 — 启动 Scrapling MCP Server,让 AI 直接操控浏览器提取数据

关键章节导航

  • 安装指南 — pip 安装、浏览器驱动、Docker 镜像
  • 快速开始 — Fetcher 选型、CSS/XPath 选择器、自适应抓取
  • 高级用法 — Spider 框架、代理轮换、MCP 服务器、CLI 工具
  • 故障排查 — 反爬虫、浏览器驱动、超时、代理问题

AI 助手能力

使用本技能时,AI 可以:

  • ✅ 安装 Scrapling 并配置浏览器驱动(scrapling install playwright / scrapling install camoufox
  • ✅ 根据目标网站自动选择最合适的 Fetcher 类
  • ✅ 编写 CSS/XPath 选择器提取目标数据
  • ✅ 配置 auto_save=Trueadaptive=True 实现自适应抓取
  • ✅ 构建完整的 Spider 类实现并发爬取,配置暂停/恢复
  • ✅ 设置代理轮换和防 DNS 泄露(DoH 模式)
  • ✅ 启动和配置 Scrapling MCP 服务器
  • ✅ 使用 CLI 工具快速测试 URL 抓取效果

核心功能

  • 三种 FetcherFetcher(快速 HTTP)、StealthyFetcher(反爬绕过)、DynamicFetcher(浏览器自动化)
  • 自适应解析 — 网页改版后自动重定位元素,降低维护成本
  • Cloudflare 绕过 — 内置 Turnstile/Interstitial 解决方案,免额外服务
  • Spider 框架 — Scrapy 风格 API,支持并发、多 Session、暂停恢复
  • 流式输出spider.stream() 实时推送抓取结果,适合大规模任务
  • MCP 服务器 — AI 工具直接调用 Scrapling 提取数据,减少 Token 消耗
  • 代理轮换 — 内置 ProxyRotator,支持循环或自定义策略
  • 会话管理FetcherSession/StealthySession/DynamicSession 跨请求保持状态
  • 开发模式 — 首次运行缓存响应,后续离线回放,快速迭代解析逻辑
  • CLI 工具 — 无需写代码直接从终端抓取页面
  • IPython Shell — 交互式调试,内置 curl 转换工具
  • Docker 镜像 — 预置所有浏览器的生产就绪镜像

快速示例

from scrapling.fetchers import Fetcher, StealthyFetcher, DynamicFetcher

# 普通 HTTP 抓取(最快)
page = Fetcher.get('https://quotes.toscrape.com/')
quotes = page.css('.quote .text::text').getall()

# 隐身模式绕过 Cloudflare
page = StealthyFetcher.fetch('https://protected-site.com', headless=True)
data = page.css('.content::text').get()

# 自适应抓取(网站改版后自动重定位)
page = Fetcher.get('https://example.com/products')
products = page.css('.product', auto_save=True)   # 首次保存元素快照
# 网站改版后:
products = page.css('.product', adaptive=True)    # 自动重新定位
# CLI 快速测试(无需写代码)
scrapling fetch https://quotes.toscrape.com/ --css ".quote .text"

# 启动 MCP 服务器
scrapling mcp

安装要求

依赖版本要求
Python>= 3.9
pip任意版本
Playwright可选(DynamicFetcher 使用)
Camoufox可选(StealthyFetcher 使用)
Docker可选(使用官方镜像)

项目链接

  • GitHub:https://github.com/D4Vinci/Scrapling
  • 文档:https://scrapling.readthedocs.io/en/latest/
  • PyPI:https://pypi.org/project/scrapling/
  • MCP 文档:https://scrapling.readthedocs.io/en/latest/ai/mcp-server.html
  • Discord:https://discord.gg/EMgGbDceNQ

适合场景

01

OpenClaw 用户查找和安装 Skill 时

02

用户想查找某类 Agent Skill 时

03

需要根据任务场景推荐可安装能力包时

04

需要对比不同来源的安装命令和来源信息时

能力概览

能力 1

按任务关键词查找相关 Skills

能力 2

展示可复制的安装命令

能力 3

保留来源站点、仓库和原始说明,方便继续核验

能力 4

补充不同宿主或平台的使用分布数据

能力 5

展示第三方安全扫描或审计结果

安装后应在对应宿主中按原始 README 的触发条件使用;具体调用方式请以来源页面和 README 为准。

平台分布

OpenClaw

85.2%
按下载量换算797

安全审计

VirusTotal

通过

ClawScan

通过

Static analysis

通过

权限和风险

操作浏览器

该 Skill 可能涉及浏览器控制能力,使用时可能读取或操作网页内容,需要在受控环境中确认权限边界。

安装前确认

本站仅展示第三方公开信息,不托管安装包,不提供自动安装或运行环境。安装前应自行审查源码、依赖和命令行为。当前只有一个来源,正式发布前建议补源仓库或其他目录站核验。

来源信息

继续浏览同类 Skills