Token导航 LogoToken导航TokenDH.com
研究检索执行命令unknown未标认证来源可访问许可证需确认审计未展示

xiaohongshu-scraper小红书刮刀

Agent Skill

xiaohongshu-scraper 用于处理浏览器自动化、网页检查和页面信息提取,适合在 Local Agent 中需要让 Agent 打开页面、读取网页或验证前端流程时使用。可结合来源仓库、安装命令和原始 README 继续核验具体用法。安装前建议确认权限范围、维护状态,以及是否会触发联网、命令执行或文件读写。

总安装

339

周安装

14

下载量

111
Local Agent

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

来源数

2

许可证

unknown

最后核验

2026-05-01

来源状态

来源可访问

安装方式

通过对话安装

复制提示词发给支持本地命令或 Skills 的 AI 助手,先确认命令和权限,再让它执行。

请帮我安装这个 Agent Skill:xiaohongshu-scraper(小红书刮刀)
来源仓库:https://skills.volces.com
仓库路径:xiaohongshu-scraper
安装命令:
安装前请先检查当前环境是否支持对应 CLI,并向我确认将要执行的命令、安装目录、联网范围和文件读写权限;确认后再执行。

命令行安装

复制命令到本机终端执行。当前暂无明确安装命令,请以来源页面说明为准。

简介

xiaohongshu-scraper 用于处理浏览器自动化、网页检查和页面信息提取。

  • 适合在 Local Agent 中让 Agent 打开页面、读取网页或验证前端流程。
  • 可通过来源仓库和安装命令进一步核验具体用法。
  • 安装前建议确认权限范围、维护状态及是否会触发联网、命令执行或文件读写。
  • 当前功能描述基于公开资料,实际能力以官方文档为准。

SKILL.md

小红书内容爬取

基于 XHS-Downloader 的小红书笔记抓取工具。

快速使用

1. 启动 API 服务(首次使用或服务未运行时)

cd /Users/lixiaoji/clawd/skills/xiaohongshu-scraper/scripts
./xhs-api-service.sh start

2. 完整抓取并保存(推荐)

# 抓取笔记,下载图片,OCR识别,保存到指定文件夹
python xhs_scraper.py "笔记URL" --output /tmp/xhs_note

# 批量抓取多个链接
python xhs_scraper.py "URL1" "URL2" "URL3" --output /tmp/xhs_notes

# 不进行 OCR(更快)
python xhs_scraper.py "笔记URL" --output /tmp/xhs_note --no-ocr

# 仅获取信息不下载
python xhs_scraper.py "笔记URL" --info-only

# 输出 JSON 格式
python xhs_scraper.py "笔记URL" --json

3. 支持的链接格式

  • https://www.xiaohongshu.com/explore/作品ID?xsec_token=XXX
  • https://www.xiaohongshu.com/discovery/item/作品ID?xsec_token=XXX
  • https://www.xiaohongshu.com/user/profile/作者ID/作品ID?xsec_token=XXX
  • https://xhslink.com/分享码(短链接)
  • 支持一次输入多个链接,空格分隔

服务管理

# 启动服务
./xhs-api-service.sh start

# 停止服务
./xhs-api-service.sh stop

# 重启服务
./xhs-api-service.sh restart

# 查看状态
./xhs-api-service.sh status

API 直接调用

服务运行后,可以直接调用 API:

# 获取笔记信息
curl -X POST http://127.0.0.1:5556/xhs/detail \
  -H "Content-Type: application/json" \
  -d '{"url": "笔记链接", "download": true}'

API 文档:http://127.0.0.1:5556/docs

输出文件结构

output_dir/
├── 作品ID/
│   ├── note.json           # 结构化数据(完整信息)
│   ├── note.md             # Markdown 文档
│   ├── images/             # 下载的图片
│   │   ├── 01.jpeg
│   │   ├── 02.jpeg
│   │   └── ...
│   └── ocr/                # OCR 识别结果
│       ├── 01.md           # 每张图片对应的 OCR 文本
│       ├── 02.md
│       └── ...

note.json 格式

{
  "note_id": "笔记ID",
  "fetch_time": "抓取时间",
  "title": "标题",
  "desc": "描述/正文",
  "type": "作品类型(图文/视频)",
  "author": {
    "nickname": "作者昵称",
    "user_id": "作者ID",
    "profile_url": "作者主页"
  },
  "interact": {
    "liked_count": 123,
    "collected_count": 456,
    "comment_count": 78,
    "share_count": 9
  },
  "tags": ["标签1", "标签2"],
  "publish_time": "发布时间",
  "last_update_time": "最后更新时间",
  "url": "笔记链接",
  "download_urls": ["下载地址列表"],
  "local_files": ["本地文件路径"],
  "ocr_results": [
    {"image": "01.jpeg", "text": "OCR识别的文字"}
  ]
}

Python 调用示例

import subprocess
import json
from pathlib import Path

def scrape_xhs_note(url: str, output_dir: str) -> dict:
    """抓取小红书笔记"""
    script = "/Users/lixiaoji/clawd/skills/xiaohongshu-scraper/scripts/xhs_scraper.py"
    result = subprocess.run(
        ["python", script, url, "--output", output_dir, "--json"],
        capture_output=True,
        text=True
    )
    if result.returncode == 0:
        return json.loads(result.stdout)
    else:
        raise Exception(result.stderr)

# 使用示例
data = scrape_xhs_note("https://www.xiaohongshu.com/explore/xxx", "/tmp/xhs")
print(data["title"])

脚本列表

脚本用途
xhs_scraper.py完整抓取工具(推荐):下载+OCR+保存
xhs_api_client.py简单客户端:仅获取信息
xhs-api-service.shAPI 服务管理脚本
xhs_download.py直接调用源码下载(无需 API)

依赖

  • XHS-Downloader(已安装在 /Users/lixiaoji/Downloads/XHS-Downloader-master-2
  • Python 3.12+
  • requests

配置路径

项目路径
XHS-Downloader 源码/Users/lixiaoji/Downloads/XHS-Downloader-master-2
默认下载目录/Users/lixiaoji/Downloads/XHS-Downloader_V2/_internal/Volume/Download
默认输出目录/Users/lixiaoji/clawd/data/xhs
API 日志/tmp/xhs-downloader-api.log

注意事项

  1. 首次使用需要先启动 API 服务
  2. 下载的文件默认保存在 XHS-Downloader 目录
  3. 使用 --output 参数将文件整理保存到指定目录
  4. OCR 功能使用 macOS 内置的 Vision 框架,仅支持 macOS
  5. 某些笔记可能有访问限制(作者设置、被删除等)
  6. 短链接需要网络请求解析,确保网络通畅

故障排除

API 服务无法启动

  1. 检查端口 5556 是否被占用:lsof -i:5556
  2. 查看日志:cat /tmp/xhs-downloader-api.log
  3. 手动启动测试: cd /Users/lixiaoji/Downloads/XHS-Downloader-master-2 source venv/bin/activate python main.py api

获取数据失败

  1. 检查链接格式是否正确
  2. 某些笔记可能有访问限制(作者设置、被删除等)
  3. 尝试在浏览器中打开链接确认笔记是否可访问

找不到下载的文件

  1. 检查下载目录是否有新文件
  2. 文件名格式为:发布时间_作者昵称_标题_序号.扩展名
  3. 等待下载完成后再查找

适合场景

01

用户想查找某类 Agent Skill 时

02

需要根据任务场景推荐可安装能力包时

03

需要对比不同来源的安装命令和来源信息时

能力概览

能力 1

按任务关键词查找相关 Skills

能力 2

展示可复制的安装命令

能力 3

保留来源站点、仓库和原始说明,方便继续核验

安装后应在对应宿主中按原始 README 的触发条件使用;具体调用方式请以来源页面和 README 为准。

平台分布

Local Agent

83.23%
按下载量换算92

安全审计

暂无安全审计结果可展示。

权限和风险

执行命令

安装流程涉及命令执行,可能通过 第三方 CLI 联网下载 Skill 或依赖。用户安装前应确认命令来源、仓库内容和执行环境。

安装前确认

本站仅展示第三方公开信息,不托管安装包,不提供自动安装或运行环境。安装前应自行审查源码、依赖和命令行为。当前只有一个来源,正式发布前建议补源仓库或其他目录站核验。

来源信息

继续浏览同类 Skills