Token导航 LogoToken导航TokenDH.com
效率需要联网clawhub未标认证来源可访问clear审计提醒

xiaofei-ziyong-wechat-article-scraper小飞自勇微信文章刷屏

Agent Skill

xiaofei-ziyong-wechat-article-scraper 用于处理浏览器自动化、网页检查和页面信息提取,适合在 OpenClaw 中需要让 Agent 打开页面、读取网页或验证前端流程时使用。可结合来源仓库、安装命令和原始 README 继续核验具体用法。安装前建议确认权限范围、维护状态,以及是否会触发联网、命令执行或文件读写。

总安装

3,410

周安装

145

GitHub Stars

公开资料未说明

下载量

1,195
OpenClaw

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

GitHub

来源数

2

许可证

MIT-0

最后核验

2026-05-01

来源状态

来源可访问

安装方式

通过对话安装

复制提示词发给支持本地命令或 Skills 的 AI 助手,先确认命令和权限,再让它执行。

请帮我安装这个 Agent Skill:xiaofei-ziyong-wechat-article-scraper(小飞自勇微信文章刷屏)
来源仓库:https://github.com/mengzi53/xiaofei-ziyong-wechat-article-scraper
安装命令:
openclaw skills install xiaofei-ziyong-wechat-article-scraper
安装前请先检查当前环境是否支持对应 CLI,并向我确认将要执行的命令、安装目录、联网范围和文件读写权限;确认后再执行。

命令行安装

复制命令到本机终端执行。该命令会通过 OpenClaw 从第三方来源获取 Skill;本站只展示命令,不托管安装包,也不自动执行。

ClawHubOpenClaw
openclaw skills install xiaofei-ziyong-wechat-article-scraper

简介

微信公众号文章抓取工具。从 mp.weixin.qq.com 抓取公开文章(文字+图片+视频),解析内容块顺序,下载图片,按原顺序写入飞书知识库。

SKILL.md

name
WeChat Article Scraper
description
微信公众号文章抓取工具。从 mp.weixin.qq.com 抓取公开文章(文字+图片+视频),解析内容块顺序,下载图片,按原顺序写入飞书知识库。
identifier
wechat-article-scraper
version
2.0.0
emoji
📱
author
xiao
tags
[wechat, china, scraping, article, feishu]
requires
bins
env
[]
primaryEnv
null

WeChat Article Scraper v2.0

微信公众号文章抓取 + 飞书导入工具。

工作流程

1. Chrome headless 抓取完整 HTML(绕过微信反爬检测)
2. 解析 HTML,提取有序内容块(文字/图片/GIF视频)
3. 下载所有文章图片到本地
4. 创建飞书知识库文档
5. 写入文字内容
6. 插入所有图片(仅支持末尾追加,这是飞书 API 限制)
7. 用户在飞书编辑器中手动拖动图片到正确位置

核心脚本

scrape.py — 纯抓取(不写飞书)

python3 ~/.openclaw/skills/wechat-article-scraper/scripts/scrape.py <文章链接>

输出 JSON:title / author / content / word_count / url

scrape_and_import.py — 完整流程

python3 ~/.openclaw/skills/wechat-article-scraper/scripts/scrape_and_import.py <文章链接> [--cache-dir /path] [--dry-run]
  • --dry-run:仅解析内容,不写飞书
  • 自动下载图片到缓存目录
  • 输出内容块结构和摘要

内容块解析逻辑

  1. 定位 id="js_content" 区域
  2. 用正则提取所有 data-src 图片(保持文章顺序)
  3. 每两张图片之间的 HTML 片段 → 清洗成纯文字
  4. GIF 图片识别为视频预览(不下载)
  5. 跳过底部干扰内容(赞赏/留言/推荐阅读)

飞书写入流程(必须按此顺序)

feishu_create_doc          → 创建空白文档
feishu_update_doc(mode=overwrite)  → 写入所有文字内容
feishu_doc_media(insert)  → 逐一插入所有图片(末尾追加)

⚠️ 关键限制

图片只能追加到文档末尾,无法插入中间位置。

原因:飞书 doc_media/insert API 不支持 block_id / position 参数,只能在文档末尾追加图片 block。

解决方案:

  1. 先写完所有文字(图片占位符用括号注明位置,如"[图1:xxx]")
  2. 再统一 insert 所有图片到末尾
  3. 用户打开飞书文档,手动拖动图片到对应文字旁边

这是飞书官方 API 限制,非工具实现问题。

图片顺序对应(文章块结构)

脚本会输出每个内容块的类型和预览文字,对应关系如下:

块序号类型说明
Ntext纯文字段落
Nimage文章图片(img_XXX.png)
NvideoGIF动态图=视频预览(不下载)

插入图片时按 img_001.png ~ img_NNN.png 文件名顺序对应文章中的图片顺序。

环境要求

  • google-chrome 已安装在 /usr/bin/google-chrome
  • 反检测参数绕过微信 UA 检测:

- --user-agent=Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36..." - --disable-blink-features=AutomationControlled" - --virtual-time-budget=20000(等待 JS 完全渲染)

适合场景

01

OpenClaw 用户查找和安装 Skill 时

02

用户想查找某类 Agent Skill 时

03

需要根据任务场景推荐可安装能力包时

04

需要对比不同来源的安装命令和来源信息时

能力概览

能力 1

按任务关键词查找相关 Skills

能力 2

展示可复制的安装命令

能力 3

保留来源站点、仓库和原始说明,方便继续核验

能力 4

补充不同宿主或平台的使用分布数据

能力 5

展示第三方安全扫描或审计结果

安装后应在对应宿主中按原始 README 的触发条件使用;具体调用方式请以来源页面和 README 为准。

平台分布

OpenClaw

92.72%
按下载量换算1,108

安全审计

VirusTotal

通过

ClawScan

可疑

Static analysis

通过

权限和风险

需要联网

该 Skill 可能需要联网访问来源站点、仓库或外部 API;具体网络访问范围需要结合源码和 README 复核。

安装前确认

本站仅展示第三方公开信息,不托管安装包,不提供自动安装或运行环境。安装前应自行审查源码、依赖和命令行为。来源安全扫描存在 warning/failed 结果,不能写成本站确认安全。当前只有一个来源,正式发布前建议补源仓库或其他目录站核验。

来源信息

继续浏览同类 Skills