Token导航 LogoToken导航TokenDH.com
研究检索敏感数据clawhub未标认证来源可访问clear审计提醒

skrollerskroller 搜索

Agent Skill

skroller 用于处理浏览器自动化、网页检查和页面信息提取,适合在 OpenClaw 中需要让 Agent 打开页面、读取网页或验证前端流程时使用。可结合来源仓库、安装命令和原始 README 继续核验具体用法。安装前建议确认权限范围、维护状态,以及是否会触发联网、命令执行或文件读写。

总安装

8,195

周安装

352

GitHub Stars

公开资料未说明

下载量

2,872
OpenClaw

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

GitHub

来源数

2

许可证

MIT-0

最后核验

2026-05-01

来源状态

来源可访问

安装方式

通过对话安装

复制提示词发给支持本地命令或 Skills 的 AI 助手,先确认命令和权限,再让它执行。

请帮我安装这个 Agent Skill:skroller(skroller 搜索)
来源仓库:https://github.com/10oss/skroller
安装命令:
openclaw skills install skroller
安装前请先检查当前环境是否支持对应 CLI,并向我确认将要执行的命令、安装目录、联网范围和文件读写权限;确认后再执行。

命令行安装

复制命令到本机终端执行。该命令会通过 OpenClaw 从第三方来源获取 Skill;本站只展示命令,不托管安装包,也不自动执行。

ClawHubOpenClaw
openclaw skills install skroller

简介

通过关键字搜索、参与过滤器、重复数据删除以及导出到 JSON、CSV 或笔记应用程序,自动抓取和过滤公共社交媒体帖子。

SKILL.md

name
skroller
description
Automated social media content collection and analysis across platforms (Twitter/X, Instagram, TikTok, Reddit, LinkedIn, YouTube, Product Hunt, Medium, GitHub, Pinterest). Use when you need to: (1) scrape public posts programmatically, (2) analyze content by keywords or filters, (3) monitor brand mentions or trends for research, (4) curate content for personal analysis, (5) archive publicly available information, or (6) generate digests from scraped feeds. Always comply with platform ToS and applicable privacy laws.

Skroller - Social Media Content collection

Automate the collection and analysis of publicly available social media content. This skill handles content collection, filtering, and export with compliance safeguards.

⚖️ Legal & Compliance Requirements

Before using this skill:

  1. Review Platform ToS - Each platform has different rules about automated access
  2. Check robots.txt - Respect disallowed paths
  3. Rate Limiting - Stay within platform rate limits to avoid service disruption
  4. Privacy Laws - GDPR, CCPA, and other regulations apply to personal data
  5. Permitted Use - Research, personal analysis, competitive intelligence (where allowed)
  6. Prohibited Use - Spam, harassment, data resale, manipulation, bypassing auth

Data Protection:

  • Anonymize personal data when storing
  • Honor deletion requests (GDPR Art. 17)
  • Limit retention to necessary periods
  • Document lawful basis for processing
  • Do not scrape sensitive personal data

Core Capabilities

  • Content collection - Gather publicly available posts from platforms
  • Data extraction - Pull text, timestamps, engagement metrics, author info
  • Smart filtering - Filter by keywords, hashtags, date ranges, engagement thresholds
  • Deduplication - Track seen posts to avoid duplicates across sessions
  • Export formats - JSON, CSV, Markdown, or direct to note apps (Bear/Obsidian)
  • Rate limiting - Respect platform constraints and avoid service disruption

Platform Support

PlatformApproachNotes
Twitter/XBrowser automationUse Playwright; handle login if needed
InstagramBrowser automationRate-limited; use sparingly
TikTokBrowser automationHeavy JS; may need longer waits
RedditAPI + browserPrefer API where possible
LinkedInBrowser automationLogin required for most content
YouTubeAPI + browserComments via browser, videos via API
Product HuntBrowser automationProduct discovery, launches
MediumBrowser automationArticles, blog posts
GitHubBrowser automationIssues, discussions, repos
PinterestBrowser automationVisual content, pins

Quick Start

Basic Scroll and Extract

# Scroll Twitter feed, extract 50 posts about "AI"
node scripts/skroller.js --platform twitter --query "AI" --limit 50 --output posts.json

Monitor Brand Mentions

# Monitor Reddit for brand mentions, export to Markdown
node scripts/skroller.js --platform reddit --query "mybrand" --format markdown --output mentions.md

Competitive Research

# Scroll competitor Instagram, capture top posts by engagement
node scripts/skroller.js --platform instagram --profile @competitor --min-likes 1000 --output competitor-posts.json

Scripts

scripts/skroller.js - Main scrolling engine

JavaScript script using Playwright for browser automation.

# Using npm scripts (recommended)
npm run scroll -- --platform twitter --query "AI" --limit 50 --output posts.json

# Direct execution
node scripts/skroller.js --platform twitter --query "AI" --limit 50 --output posts.json

Options:

  • --platform - Target platform (required): twitter, reddit, instagram, tiktok, linkedin, youtube, producthunt, medium, github, pinterest
  • --query - Search keyword/hashtag
  • --profile - Specific profile to scroll
  • --limit - Max posts to scrape (default: 50)
  • --min-likes - Filter by minimum engagement
  • --format - Output format: json, csv, markdown (default: json)
  • --output - Output file path
  • --screenshot - Capture screenshots for debugging
  • --dedupe - Skip previously seen posts

scripts/feed-digest.js - Generate digests

Creates summary digests from exported post data.

npm run digest -- --input posts.json --output digest.md
# or: node scripts/feed-digest.js --input posts.json --output digest.md

scripts/export-to-notes.js - Unified note app exporter

Exports scraped posts to multiple note applications with a single command.

Supported apps: Bear, Obsidian, Notion, Apple Notes, Evernote, OneNote, Google Keep, Roam Research, Logseq, Anytype

# Using npm scripts (recommended)
npm run export -- --input posts.json --app obsidian --vault ~/Documents/Obsidian

# Direct execution
node scripts/export-to-notes.js --input posts.json --app bear --tags "ai,research"
node scripts/export-to-notes.js --input posts.json --app notion --api-key $NOTION_TOKEN
node scripts/export-to-notes.js --input posts.json --app apple-notes
node scripts/export-to-notes.js --input posts.json --app evernote --output export.enex
node scripts/export-to-notes.js --input posts.json --app one-note --access-token $MS_TOKEN
node scripts/export-to-notes.js --input posts.json --app keep --output keep.html
node scripts/export-to-notes.js --input posts.json --app roam --output roam.md
node scripts/export-to-notes.js --input posts.json --app logseq --vault ~/Documents/Logseq
node scripts/export-to-notes.js --input posts.json --app anytype --output anytype.md
node scripts/export-to-notes.js --input posts.json --app obsidian --dry-run

Configuration: Set defaults in .skroller-config.json:

{
  "export": {
    "defaultApp": "obsidian",
    "vault": "~/Documents/Obsidian",
    "folder": "Skroller",
    "notionDatabaseId": "<db-id>"
  }
}

Requirements by app:

  • Bear: grizzly CLI (go install github.com/tylerwince/grizzly/cmd/grizzly@latest)
  • Obsidian: Vault path
  • Notion: API key (create at notion.so)
  • Apple Notes: macOS with Notes app
  • Evernote: Manual ENEX import
  • OneNote: Microsoft Graph access token
  • Google Keep: Manual HTML import
  • Roam Research: Markdown import (drag MDL file into Roam)
  • Logseq: Vault path (writes to pages/ folder)
  • Anytype: Markdown import (use Anytype Import feature)

Configuration

.skroller-config.json

Store default settings:

{
  "defaultLimit": 50,
  "scrollDelayMs": 1500,
  "userAgent": "Mozilla/5.0 ...",
  "platforms": {
    "twitter": {
      "loginRequired": false,
      "rateLimit": "100 requests/hour"
    },
    "instagram": {
      "loginRequired": true,
      "rateLimit": "50 requests/hour"
    }
  },
  "export": {
    "defaultFormat": "json",
    "includeImages": true,
    "includeMetrics": true
  }
}

Authentication

Some platforms require login. Store credentials securely:

# For platforms requiring auth, set environment variables
export SKROLLR_TWITTER_COOKIE="<auth cookie>"
export SKROLLR_INSTAGRAM_USER="<username>"
export SKROLLR_INSTAGRAM_PASS="<password>"

Security note: Never commit auth files. Use .env with .gitignore.

Output Structure

JSON Output (default)

{
  "platform": "twitter",
  "query": "AI",
  "scrapedAt": "2026-03-14T20:30:00Z",
  "posts": [
    {
      "id": "1234567890",
      "author": "@username",
      "text": "Post content here...",
      "timestamp": "2026-03-14T18:00:00Z",
      "likes": 150,
      "retweets": 42,
      "replies": 12,
      "url": "https://twitter.com/...",
      "media": ["image1.jpg"],
      "hashtags": ["#AI", "#ML"]
    }
  ]
}

Markdown Output

## Twitter Posts: "AI" (2026-03-14)

### @username - 150 likes
Post content here...

[View post](https://twitter.com/...)

---

Filtering Strategies

Keyword Matching

  • Exact match: "exact phrase"
  • Boolean: AI AND (startup OR venture)
  • Exclude: AI -crypto

Engagement Thresholds

  • Filter low-quality: --min-likes 100
  • Viral content: --min-shares 500

Time Windows

  • Recent only: --date-from 2026-03-14
  • Historical: --date-from 2026-01-01 --date-to 2026-01-31

Best Practices

Rate Limiting

  • Add delays between scrolls: --delay 2000
  • Respect platform limits (see config)
  • Use proxies for high-volume scraping

Content Quality

  • Filter by engagement to find signal
  • Dedupe across sessions
  • Export with timestamps for freshness tracking

Ethics & Compliance

  • Check platform ToS before scraping
  • Don't scrape personal data at scale
  • Use for research/curation, not spam

Troubleshooting

Scroll stops early

  • Increase --limit or check for login requirements
  • Some platforms detect automation; add random delays

Missing content

  • Some platforms lazy-load; increase scroll delay
  • Try --screenshot to debug what's visible

Rate limited

  • Reduce frequency; use --delay
  • Check platform-specific rate limits in config

Integration with Other Skills

  • bear-notes: Export via export-to-notes.js --app bear
  • obsidian: Export via export-to-notes.js --app obsidian
  • notion: Export via export-to-notes.js --app notion
  • github: Create issues from scraped feedback/mentions
# Scroll and export to Obsidian in one command
node scripts/skroller.js --platform twitter --query "AI" --limit 20 --output ai.json && \
  node scripts/export-to-notes.js --input ai.json --app obsidian --vault ~/Documents/Obsidian

# Scroll and export to Notion
node scripts/skroller.js --platform reddit --query "startups" --limit 30 --output startups.json && \
  node scripts/export-to-notes.js --input startups.json --app notion --api-key $NOTION_TOKEN

# Use npm scripts for cleaner commands
npm run scroll -- --platform twitter --query "tech" --limit 25 --output tech.json
npm run export -- --input tech.json --app bear --tags "tech,research"

See Also

  • references/platform-details.md - Platform-specific selectors and quirks
  • references/rate-limits.md - Rate limit guidelines per platform
  • assets/selector-cheatsheet.md - CSS selectors for each platform

适合场景

01

OpenClaw 用户查找和安装 Skill 时

02

用户想查找某类 Agent Skill 时

03

需要根据任务场景推荐可安装能力包时

04

需要对比不同来源的安装命令和来源信息时

能力概览

能力 1

按任务关键词查找相关 Skills

能力 2

展示可复制的安装命令

能力 3

保留来源站点、仓库和原始说明,方便继续核验

能力 4

补充不同宿主或平台的使用分布数据

能力 5

展示第三方安全扫描或审计结果

安装后应在对应宿主中按原始 README 的触发条件使用;具体调用方式请以来源页面和 README 为准。

平台分布

OpenClaw

87.84%
按下载量换算2,523

安全审计

VirusTotal

可疑

ClawScan

可疑

Static analysis

可疑

权限和风险

敏感数据

该 Skill 可能接触密钥、Token、环境变量或敏感配置,应进入高风险复核队列,默认不自动发布。

安装前确认

本站仅展示第三方公开信息,不托管安装包,不提供自动安装或运行环境。安装前应自行审查源码、依赖和命令行为。来源安全扫描存在 warning/failed 结果,不能写成本站确认安全。当前只有一个来源,正式发布前建议补源仓库或其他目录站核验。

来源信息

继续浏览同类 Skills