Token导航 LogoToken导航TokenDH.com
研究检索操作浏览器clawhub未标认证来源可访问clear审计提醒

browser-ops浏览器操作

Agent Skill

browser-ops 用于处理浏览器自动化、网页检查和页面信息提取,适合在 OpenClaw 中需要让 Agent 打开页面、读取网页或验证前端流程时使用。可结合来源仓库、安装命令和原始 README 继续核验具体用法。安装前建议确认权限范围、维护状态,以及是否会触发联网、命令执行或文件读写。

总安装

4,848

周安装

166

GitHub Stars

公开资料未说明

下载量

1,584
OpenClaw

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

GitHub

来源数

2

许可证

MIT-0

最后核验

2026-05-01

来源状态

来源可访问

安装方式

通过对话安装

复制提示词发给支持本地命令或 Skills 的 AI 助手,先确认命令和权限,再让它执行。

请帮我安装这个 Agent Skill:browser-ops(浏览器操作)
来源仓库:https://github.com/lanyasheng/browser-ops
安装命令:
openclaw skills install browser-ops
安装前请先检查当前环境是否支持对应 CLI,并向我确认将要执行的命令、安装目录、联网范围和文件读写权限;确认后再执行。

命令行安装

复制命令到本机终端执行。该命令会通过 OpenClaw 从第三方来源获取 Skill;本站只展示命令,不托管安装包,也不自动执行。

ClawHubOpenClaw
openclaw skills install browser-ops

简介

browser-ops 是网页访问的成本优化路由决策工具。

  • 按费用从低到高逐级升级抓取策略。适用宿主包括 OpenClaw,接入前应确认版本、权限和运行环境要求。
  • 零 MCP 依赖,避免上下文 token 占用。
  • 适用于预算敏感型数据整理场景。browser-ops 属于研究检索类 Skill,可作为该场景下的辅助能力补充。
  • 建议结合实际站点特性选择合适层级组合。

SKILL.md

name
browser-ops
description
>-
IMPORTANT
For sites with opencli adapters (74 sites), use opencli <platform> directly — NEVER WebFetch/web read. For other sites, start with WebFetch. NEVER jump to browser-use/agent-browser first.
triggers
license
MIT

Browser Operations — 网页访问路由决策指南

全 CLI 架构。所有工具通过 Bash 调用,零 MCP 依赖,不占常驻上下文。 核心原则:能用 HTTP 就不开浏览器,能用 opencli 就不用 browser-use。

核心规则

MUST 从免费层开始。NEVER 直接跳到浏览器工具。

每次网页任务按这个顺序判断,命中就停

  1. 目标是 opencli 已适配平台?→ 直接 opencli <platform> <command>,跳过 WebFetch

判断方法:URL 域名或用户意图命中已适配站点(opencli list 查看完整列表,74 个站点 454 条命令)。 常见已适配平台:twitter/x.com, zhihu, weibo, bilibili, hackernews, xiaohongshu, douyin, reddit, youtube, github, arxiv, bloomberg, linkedin, douban, jd, wikipedia, v2ex, tieba, spotify, steam, medium, substack, producthunt, stackoverflow, 36kr, weread, xueqiu 等。 这些平台有专属适配器,返回结构化数据,比 web read 更准确更高效。

  1. WebFetch/WebSearch 能搞定(非已适配平台)?→ 用它,$0
  2. 403/SSO/空?→ opencli web read,$0,Cookie 零配置
  3. 需要 JS 渲染/结构化?→ firecrawl scrape "url"
  4. 需要交互(≤3 步)?→ opencli operate,Cookie 零配置
  5. 需要精确控制/Ref/录制?→ agent-browser,@e1 稳定引用
  6. 需要 AI 自主多步?→ browser-use -p "任务",$0.01-0.05/步
  7. 被反爬拦截?→ zendriver

违反顺序 = 浪费钱或丢失数据。已适配平台用 opencli web read 只能拿到 HTML,用 opencli <platform> 能拿到结构化字段。

<anti-example> 用户: "搜一下 Twitter 上关于 AI agent 的讨论" 错误: opencli web read --url "https://x.com/search?q=AI+agent" → 拿到 HTML 残片 正确: opencli twitter search "AI agent" → 结构化推文列表 (id, author, text, likes, views) </anti-example>

<anti-example> 用户: "帮我看看知乎热榜" 错误: WebFetch("https://www.zhihu.com/hot") → 空/SPA 空壳 正确: opencli zhihu hot → 结构化热榜列表 </anti-example>

<anti-example> 用户: "帮我看看 https://example.com/article 的内容" 错误: browser-use -p "extract content from example.com" → $0.05 正确: WebFetch("https://example.com/article") → $0 (example.com 不是已适配平台) </anti-example>

<anti-example> 用户: "帮我读一下内部网站的这篇文章 https://internal.company.com/doc/123" 错误: WebFetch → 403 → 放弃,说"无法访问" 正确: WebFetch → 403 → 自动升级到 opencli web read (带 Chrome Cookie) </anti-example>

条件判断规则

当 WebFetch 返回 403 或 302 到登录页时 → 自动升级到 opencli web read,不要询问用户。 当 opencli web read 返回 exit 77 时 → SSO/Cookie 过期,MUST 停止降级,直接提示用户回 Chrome 登录后重试。后续工具 (firecrawl/agent-browser) 也没有登录态,继续降级只是浪费。 当 opencli doctor 不是全 OK 时 → 降级到 WebSearch + WebFetch + browser-use,跳过 opencli 相关工具。 当任务需要填表但不确定表单字段时 → 先用 opencli operate state 获取可交互元素列表,确认字段后再操作。 如果不确定用哪个工具 → 询问用户或从最便宜的 WebFetch 开始逐级升级。

已适配平台 MUST 直接用 opencli <platform>,NEVER 走 WebFetch/web read 通路,otherwise 丢失结构化数据。 非已适配平台 MUST 从 WebFetch 开始,otherwise 每个请求多花 $0.01-0.05 且速度慢 10 倍。 NEVER 用 browser-use 做简单读取,otherwise 一次 $0.05 的操作 WebFetch $0 就能完成。 不要跳过 opencli web read 直接用 Firecrawl,而是先试免费的 Cookie 路径。

Output

返回给用户时 MUST 包含:

  • 提取到的内容(Markdown 格式)
  • 实际使用的工具和原因(如 "WebFetch 返回 403,已自动升级到 opencli web read")
  • 如果全部失败,给出具体原因和用户可操作的建议(如 "需要在 Chrome 中重新登录")

returns: 网页内容 (Markdown) + 工具链路径 + 失败原因(如有)

路由决策树

收到任务
│
├─ 0. opencli 可用? → opencli doctor (3 个 OK)
│     否 → 降级: WebSearch + WebFetch + browser-use
│
├─ 1. 目标是已适配平台? (URL 域名 或 用户意图 命中 opencli list 中的站点)
│     是 → 直接 opencli <platform> <command>,跳过 WebFetch/web read
│     例: twitter/x.com → opencli twitter search/timeline/trending
│         zhihu.com → opencli zhihu hot/search/answer
│         bilibili.com → opencli bilibili search/hot/subtitle
│
├─ 2. 要搜索(没 URL,非已适配平台)?
│     ├─ WebSearch (内置, 始终可用)
│     ├─ 深度搜索 → tavily search "query" --search-depth advanced
│     ├─ 独立索引 → curl brave API
│     └─ fallback → opencli google search
│
├─ 3. 有 URL,非已适配平台?
│     ├─ WebFetch ($0) → 403/SSO? → opencli web read ($0, Cookie 直连)
│     │     ├─ exit 77 (SSO 过期) → 停止降级,提示用户回 Chrome 登录
│     │     └─ 其他失败 (JS 不足/内容太短) → 继续降级到 firecrawl
│     └─ JS 渲染/PDF/结构化 → firecrawl scrape "url"
│
├─ 4. 要交互?
│     ├─ ≤3 步 → opencli operate (Cookie 零配置, 17 个命令)
│     │   open → state → click/type/select/scroll → screenshot → close
│     ├─ 需要稳定引用/录制/标注截图 → agent-browser (60+ 命令)
│     │   open → snapshot -i → click @e1 → screenshot --annotate
│     ├─ AI 自主多步 → browser-use -p "自然语言任务"
│     └─ 未知 DOM → Stagehand act("点击登录")
│
├─ 5. 被反爬? → python -c "import zendriver as zd; ..."
│
└─ 全失败 → 告知用户具体原因和建议,NEVER 静默失败

升级信号

当前工具返回升级到命令
WebFetch → 403/302 登录页opencli web readopencli web read --url "url"
WebFetch → 空/SPA 空壳Firecrawlfirecrawl scrape "url"
opencli → exit 77停止降级,提示用户SSO 过期,后续工具也没登录态,直接提示用户回 Chrome 登录
需要点击/填表opencli operateopencli operate open "url" && state
编号 [N] 不稳定agent-browseragent-browser snapshot -iclick @e1
多步复杂任务browser-usebrowser-use -p "任务描述"
Cloudflare 拦截页Zendriverpython3 -c "import zendriver..."

搜索工具

# 内置 (始终可用)
WebSearch → Claude Code 内置,直接调用

# Tavily — AI 原生搜索,返回 answer + results (免费 1000 次/月)
tavily search "query"                              # pip install tavily-python
tavily search "query" --search-depth advanced       # 深度模式
tavily extract "https://url"                        # URL 内容提取

# Brave — 独立索引,不依赖 Google/Bing
curl -s "https://api.search.brave.com/res/v1/web/search?q=query" \
  -H "X-Subscription-Token: $BRAVE_API_KEY"

# Firecrawl — JS 渲染 + Markdown 提取 (免费 500 次)
firecrawl scrape "https://url"                     # pip install firecrawl
firecrawl crawl "https://url" --limit 10           # 批量
firecrawl map "https://url"                        # URL 发现

# 平台搜索 — 75 站点结构化数据
opencli twitter trending / zhihu hot / hackernews top / xiaohongshu search "旅行"
opencli list                                       # 查看所有适配器

浏览器交互工具

# opencli operate — 简单交互,Cookie 零配置 (通过 Chrome Extension 直连)
opencli operate open "url"
opencli operate state                              # 可交互元素 [1][2][3]
opencli operate click 5 / type 3 "hello" / select 2 "选项A"
opencli operate scroll down / keys Enter / wait text "Success"
opencli operate screenshot /tmp/shot.png / network / close

# agent-browser — 复杂交互,@e1 Ref 引用 (基于 Accessibility Tree,页面重渲染不变)
agent-browser open "url" && agent-browser snapshot -i
agent-browser click @e2 / fill @e3 "hello"         # Ref 引用
agent-browser screenshot --annotate /tmp/a.png     # 标注截图
agent-browser record start                        # 录制操作
agent-browser batch "click @e1 && wait 1000 && screenshot"
agent-browser --auto-connect snapshot              # 连接已运行 Chrome
# 搭配 Lightpanda 省 token: snapshot ~500 token vs Chrome ~3000 token
# ./lightpanda serve --port 9222 && agent-browser connect 9222

# browser-use — AI 自主操作 (LLM 决策循环,每步 $0.01-0.05)
browser-use -p "去 example.com 注册账号"            # 自然语言驱动
browser-use --connect -p "任务"                     # 连接已运行 Chrome
browser-use run --remote "任务"                     # 云端执行

opencli operate vs agent-browser

维度opencli operateagent-browser
场景≤3 步简单操作复杂/精确操作
元素定位[N] 编号(页面变了会变)@e1 Ref(稳定,基于 ARIA role+name)
CookieChrome Extension 直连,零配置--profile / --auto-connect
标注截图✅ --annotate(给视觉模型用)
录制回放✅ record(固定流程自动化)
批量/DOM diff✅ batch / diff
内核替换✅ Lightpanda(省 80% token)
命令数1760+
iOS 测试✅ -p ios

前置条件

# 必装
npm i -g @jackwener/opencli
# Chrome 装 OpenCLI Browser Bridge: $(npm root -g)/@jackwener/opencli/extension
opencli doctor  # 3 个 OK 才能用

# 按需 (全 CLI,不需要配 MCP)
npm i -g agent-browser               # Ref 引用/录制/标注截图

> See references/ for extended content.

适合场景

01

OpenClaw 用户查找和安装 Skill 时

02

用户想查找某类 Agent Skill 时

03

需要根据任务场景推荐可安装能力包时

04

需要对比不同来源的安装命令和来源信息时

能力概览

能力 1

按任务关键词查找相关 Skills

能力 2

展示可复制的安装命令

能力 3

保留来源站点、仓库和原始说明,方便继续核验

能力 4

补充不同宿主或平台的使用分布数据

能力 5

展示第三方安全扫描或审计结果

安装后应在对应宿主中按原始 README 的触发条件使用;具体调用方式请以来源页面和 README 为准。

平台分布

OpenClaw

88.36%
按下载量换算1,400

安全审计

VirusTotal

通过

ClawScan

可疑

Static analysis

通过

权限和风险

操作浏览器

该 Skill 可能涉及浏览器控制能力,使用时可能读取或操作网页内容,需要在受控环境中确认权限边界。

安装前确认

本站仅展示第三方公开信息,不托管安装包,不提供自动安装或运行环境。安装前应自行审查源码、依赖和命令行为。来源安全扫描存在 warning/failed 结果,不能写成本站确认安全。当前只有一个来源,正式发布前建议补源仓库或其他目录站核验。

来源信息

继续浏览同类 Skills