Token导航 LogoToken导航TokenDH.com
研究检索只读clawhub未标认证来源可访问clear审计提醒

doorstep-screen-control门口屏幕控制

Agent Skill

doorstep-screen-control 用于查找、检索和筛选相关信息,适合在 OpenClaw 中需要根据关键词、任务场景或来源线索快速定位候选结果时使用。可结合来源仓库、安装命令和原始 README 继续核验具体用法。安装前建议确认权限范围、维护状态,以及是否会触发联网、命令执行或文件读写。

总安装

1,818

周安装

75

GitHub Stars

公开资料未说明

下载量

594
OpenClaw

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

GitHub

来源数

2

许可证

MIT-0

最后核验

2026-05-01

来源状态

来源可访问

安装方式

通过对话安装

复制提示词发给支持本地命令或 Skills 的 AI 助手,先确认命令和权限,再让它执行。

请帮我安装这个 Agent Skill:doorstep-screen-control(门口屏幕控制)
来源仓库:https://github.com/ncsimok/doorstep-screen-control
安装命令:
openclaw skills install doorstep-screen-control
安装前请先检查当前环境是否支持对应 CLI,并向我确认将要执行的命令、安装目录、联网范围和文件读写权限;确认后再执行。

命令行安装

复制命令到本机终端执行。该命令会通过 OpenClaw 从第三方来源获取 Skill;本站只展示命令,不托管安装包,也不自动执行。

ClawHubOpenClaw
openclaw skills install doorstep-screen-control

简介

doorstep-screen-control 通过 pyautogui 实现电脑屏幕识别与控制。

  • 适合在 OpenClaw 中进行远程操作和视觉自动化任务。
  • 支持截图OCR图片匹配鼠标键盘操控等功能。
  • 安装前需在本地环境部署 Node 和依赖库。
  • 适用于远程办公和自动化脚本执行场景。doorstep-screen-control 属于研究检索类 Skill,可作为该场景下的辅助能力补充。

SKILL.md

name
screen-control
description
屏幕控制技能 - 通过OpenClaw Node + pyautogui实现电脑屏幕识别和鼠标键盘操控。功能:(1) 截图获取屏幕画面,(2) OCR文字识别定位,(3) 图片匹配定位,(4) 鼠标移动/点击/拖拽,(5) 键盘输入/快捷键,(6) 基于视觉信息的自动化操作。Use when: (1) 需要远程操电脑屏幕,(2) 需要自动操作桌面应用(非浏览器),(3) 需要批量处理电脑上的文件或软件,(4) 需要通过视觉识别自动化操作。Triggers: '操作电脑', '屏幕控制', '自动点击', '截图识别', '桌面自动化', '远程操控', '操控鼠标', '屏幕识别'。

Screen Control — 屏幕操控技能

概述

通过 OpenClaw Node + pyautogui + OCR,实现对电脑屏幕的识别和鼠标键盘操控。

架构

用户指令 → Agent → screen_control.py (pyautogui + OCR) → 屏幕操作
                    ↕
              OpenClaw Node (截图/远程执行)

前置条件

  1. OpenClaw Node — 需配对成功(见 references/setup-guide.md)
  2. Python依赖 — pyautogui, pillow, mss, pytesseract(如需OCR)
  3. Tesseract-OCR — 如需文字识别功能(安装指引见 setup-guide.md)

工作流程

当用户要求操控电脑时:

Step 1:确认屏幕状态

python {baseDir}/scripts/screen_control.py screenshot
python {baseDir}/scripts/screen_control.py size

获取当前屏幕画面和分辨率,AI识别画面内容。

Step 2:分析画面 + 定位目标

AI分析截图,确定需要操作的坐标或内容。

  • 如果目标基于图片locate <image_path>
  • 如果目标基于文字clicktext "确定"
  • 如果目标基于坐标click 500 300

Step 3:执行操作

# 打开浏览器
press_key("win") + type_text("chrome") + press_key("enter")

# 打开网页
type_text("douyin.com\
")  # \
 = enter

# 拖动
mouse_drag(100, 100, 500, 500)

# 复制粘贴
hotkey("ctrl", "c")
hotkey("ctrl", "v")

Step 4:验证结果

再次截图确认操作结果。

脚本命令速查

命令参数说明
screenshot截图保存到文件
size获取屏幕分辨率
movex y移动鼠标
clickx y [button]点击(按钮: left/right/middle)
doubleclickx y双击
text"文字"键盘输入文字
keykey_name按键(enter/esc/tab等)
locateimage_path查找图片位置
findtext"文字"查找文字位置
clicktext"文字"查找并点击文字
scrollclicks滚动(正=上,负=下)
colorx y获取像素颜色

常用场景

1. 自动登录平台后台

截图 → 定位登录框坐标 → 输入账号密码 → 点击登录按钮

2. 批量操作抖音/小红书后台

截图 → 找到发布按钮 → 点开 → 上传视频/图片 → 填写标题 → 发布

3. 打开特定软件/文件

按Win键 → 搜索程序名 → 回车打开

4. 文件整理/批量重命名

打开文件夹 → 选中文件 → 执行操作

安全注意

  1. 操作前先截图给用户确认
  2. 任何破坏性操作(删除文件、修改配置)需用户确认
  3. 使用 pyautogui.FAILSAFE=True(左上角急停)
  4. 不要在用户未授权的情况下操作浏览器密码/支付页面

适合场景

01

OpenClaw 用户查找和安装 Skill 时

02

用户想查找某类 Agent Skill 时

03

需要根据任务场景推荐可安装能力包时

04

需要对比不同来源的安装命令和来源信息时

能力概览

能力 1

按任务关键词查找相关 Skills

能力 2

展示可复制的安装命令

能力 3

保留来源站点、仓库和原始说明,方便继续核验

能力 4

补充不同宿主或平台的使用分布数据

能力 5

展示第三方安全扫描或审计结果

安装后应在对应宿主中按原始 README 的触发条件使用;具体调用方式请以来源页面和 README 为准。

平台分布

OpenClaw

88%
按下载量换算523

安全审计

VirusTotal

可疑

ClawScan

可疑

Static analysis

通过

权限和风险

只读

该 Skill 主要提供规则、说明或参考内容,本身偏只读;真正读写文件、联网或执行命令仍取决于宿主 Agent 的任务。

安装前确认

本站仅展示第三方公开信息,不托管安装包,不提供自动安装或运行环境。安装前应自行审查源码、依赖和命令行为。来源安全扫描存在 warning/failed 结果,不能写成本站确认安全。当前只有一个来源,正式发布前建议补源仓库或其他目录站核验。

来源信息

继续浏览同类 Skills