Token导航 LogoToken导航TokenDH.com
研究检索操作浏览器github未标认证来源可访问许可证需确认审计异常

browser-agent浏览器 Agent

Agent Skill

用于辅助云资源、部署、容器、基础设施和运维自动化任务。它适合让 Agent 检查配置、整理部署步骤、分析资源状态、生成排障思路或辅助云服务接入。使用时需要明确目标环境、账号权限、区域和资源组,区分本地测试与生产操作;涉及删除资源、重启服务、修改网络或权限配置时,应先确认影响范围。

总安装

582

周安装

25

GitHub Stars

1

下载量

204
CodexClaudeCursorGemini CLI

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

GitHub

来源数

2

许可证

unknown

最后核验

2026-05-01

来源状态

来源可访问

安装方式

通过对话安装

复制提示词发给支持本地命令或 Skills 的 AI 助手,先确认命令和权限,再让它执行。

请帮我安装这个 Agent Skill:browser-agent(浏览器 Agent)
来源仓库:https://github.com/azure12355/weilan-skills
仓库路径:skills/browser-agent
安装命令:
npx skills add https://github.com/azure12355/weilan-skills --skill browser-agent
安装前请先检查当前环境是否支持对应 CLI,并向我确认将要执行的命令、安装目录、联网范围和文件读写权限;确认后再执行。

命令行安装

复制命令到本机终端执行。该命令会通过 npx skills 从第三方来源获取 Skill;本站只展示命令,不托管安装包,也不自动执行。

skills.shnpx skills
npx skills add https://github.com/azure12355/weilan-skills --skill browser-agent

简介

提供浏览器自动化工具集,支持网页内容提取与交互操作。

  • 包含三种工具:静态抓取、无障碍树解析及专用 actionbook 食谱。
  • 适用于数据整理、反爬绕过或多步骤任务自动化场景。
  • 使用前需确认目标网站是否允许自动化访问及相关法律合规要求。
  • browser-agent 属于研究检索类 Skill,可作为该场景下的辅助能力补充。

SKILL.md

Browser Agent

AI Agent 浏览器自动化工具集,提供三种互补的工具用于网页数据获取和自动化操作。

工具选择指南

用户请求
    │
    ├── 简单抓取静态内容?
    │   └── 用 curl / WebFetch(更快)
    │
    ├── 需要 JS 渲染 / 绕过反爬?
    │   ├── agent-browser ── 提取无障碍树
    │   │
    │   ├── 截图? ── agent-browser -s
    │   │
    │   └── 目标网站在 actionbook 列表?
    │       └── actionbook get <site> ── 获取专用食谱
    │
    └── 复杂多步骤自动化?
        └── browser-use (Python) ── AI 驱动自主操作

agent-browser

CLI 工具,使用 Playwright 启动无头浏览器并提取页面的无障碍树(Accessibility Tree)。

核心优势

  • 无需登录即可访问大部分内容
  • 获取结构化的可读文本
  • 支持截图
  • 自动处理 JS 渲染

基本用法

# 提取网页内容(无障碍树)
agent-browser <URL>

# 截图
agent-browser -s <URL>

# 指定输出格式
agent-browser -f markdown <URL>
agent-browser -f html <URL>
agent-browser -f text <URL>

# 交互模式(可点击、滚动)
agent-browser -i <URL>

# 指定浏览器
agent-browser --browser chromium <URL>
agent-browser --browser firefox <URL>

常见场景

# 获取 X/Twitter 帖子内容
agent-browser "https://x.com/username/status/123456"

# 获取 GitHub 仓库信息
agent-browser "https://github.com/owner/repo"

# 获取 Reddit 帖子
agent-browser "https://reddit.com/r/subreddit/comments/abc123"

# 获取新闻文章(JS 渲染)
agent-browser "https://example.com/article"

详细命令参考: references/agent-browser-reference.md

actionbook

50+ 网站的预计算自动化"食谱",提供经过验证的自动化模板。

基本用法

# 列出所有支持的网站
actionbook list

# 获取特定网站的食谱
actionbook get <site>

# 示例
actionbook get github
actionbook get reddit
actionbook get amazon

工作流程

  1. 运行 actionbook list 查看支持的网站
  2. 运行 actionbook get <site> 获取该网站的自动化模板
  3. 根据模板编写自动化脚本(使用 browser-use 或直接使用 agent-browser)

详细命令参考: references/actionbook-reference.md

browser-use

Python 库,使用 AI 自主控制浏览器完成复杂任务。

安装

pip install browser-use
playwright install chromium

基本用法

from browser_use import Agent
from langchain_openai import ChatOpenAI

async def main():
    agent = Agent(
        task="Go to GitHub and find the trending Python repositories",
        llm=ChatOpenAI(model="gpt-4"),
    )
    result = await agent.run()
    print(result)

常见场景

# 表单填写
agent = Agent(
    task="Go to example.com and fill out the contact form with test data",
    llm=llm,
)

# 数据抓取
agent = Agent(
    task="Go to Amazon, search for 'wireless headphones', and extract the top 5 products with prices",
    llm=llm,
)

# 多步骤操作
agent = Agent(
    task="Log into Twitter, navigate to settings, and enable two-factor authentication",
    llm=llm,
)

详细 API 参考: references/browser-use-reference.md

决策流程

任务类型 → 工具选择

任务类型推荐工具原因
快速抓取单个页面agent-browser简单直接,无障碍树输出
需要页面截图agent-browser -s内置截图功能
目标网站在 actionbook 中actionbook + browser-use有现成的最佳实践
复杂多步骤操作browser-useAI 自主决策和执行
需要登录的网站browser-use可以处理登录流程
批量数据整理browser-use支持循环和条件判断

示例工作流

场景:获取 X/Twitter 帖子内容

# 方法 1:直接使用 agent-browser(推荐)
agent-browser "https://x.com/username/status/123456"

# 方法 2:使用 browser-use 进行更复杂操作
# 编写 Python 脚本

场景:GitHub Trending 分析

# 方法 1:agent-browser
agent-browser "https://github.com/trending"

# 方法 2:使用 actionbook 获取 GitHub 食谱
actionbook get github
# 然后根据食谱编写脚本

注意事项

  1. 速率限制:频繁请求可能被目标网站封禁,建议添加延迟
  2. 登录要求:某些内容需要登录才能访问,使用 browser-use 处理
  3. 动态内容:agent-browser 会等待页面加载完成,但对于无限滚动页面需要交互模式
  4. 法律合规:确保抓取行为符合目标网站的服务条款

故障排除

问题解决方案
页面加载超时使用 -t 增加超时时间
内容未渲染使用交互模式 -i 手动等待
反爬虫拦截尝试不同的 user-agent 或使用 browser-use
截图空白确保页面完全加载后再截图

适合场景

01

用户想查找某类 Agent Skill 时

02

需要根据任务场景推荐可安装能力包时

03

需要对比不同来源的安装命令和来源信息时

能力概览

能力 1

按任务关键词查找相关 Skills

能力 2

展示可复制的安装命令

能力 3

保留来源站点、仓库和原始说明,方便继续核验

能力 4

展示第三方安全扫描或审计结果

安装后应在对应宿主中按原始 README 的触发条件使用;具体调用方式请以来源页面和 README 为准。

平台分布

Codex

37.66%
按下载量换算77

Claude

29.88%
按下载量换算61

Cursor

17.84%
按下载量换算36

Gemini CLI

9.9%
按下载量换算20

安全审计

Gen Agent Trust Hub

未通过

Socket

通过

Snyk

可疑

权限和风险

操作浏览器

该 Skill 可能涉及浏览器控制能力,使用时可能读取或操作网页内容,需要在受控环境中确认权限边界。

安装前确认

本站仅展示第三方公开信息,不托管安装包,不提供自动安装或运行环境。安装前应自行审查源码、依赖和命令行为。来源安全扫描存在 warning/failed 结果,不能写成本站确认安全。当前只有一个来源,正式发布前建议补源仓库或其他目录站核验。

来源信息

继续浏览同类 Skills