Token导航 LogoToken导航TokenDH.com
研究检索权限需确认clawhub未标认证来源可访问clear审计通过

pdf-figure-extractorPDF figure extractor 搜索

Agent Skill

pdf-figure-extractor 用于查找、检索和筛选相关信息,适合在 OpenClaw 中需要根据关键词、任务场景或来源线索快速定位候选结果时使用。可结合来源仓库、安装命令和原始 README 继续核验具体用法。安装前建议确认权限范围、维护状态,以及是否会触发联网、命令执行或文件读写。

总安装

6,565

周安装

282

GitHub Stars

公开资料未说明

下载量

2,301
OpenClaw

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

GitHub

来源数

2

许可证

MIT-0

最后核验

2026-05-01

来源状态

来源可访问

安装方式

通过对话安装

复制提示词发给支持本地命令或 Skills 的 AI 助手,先确认命令和权限,再让它执行。

请帮我安装这个 Agent Skill:pdf-figure-extractor(PDF figure extractor 搜索)
来源仓库:https://github.com/438061781/pdf-figure-extractor
安装命令:
openclaw skills install pdf-figure-extractor
安装前请先检查当前环境是否支持对应 CLI,并向我确认将要执行的命令、安装目录、联网范围和文件读写权限;确认后再执行。

命令行安装

复制命令到本机终端执行。该命令会通过 OpenClaw 从第三方来源获取 Skill;本站只展示命令,不托管安装包,也不自动执行。

ClawHubOpenClaw
openclaw skills install pdf-figure-extractor

简介

从PDF论文中精确提取Figure图片,自动分析PDF结构、定位caption位置、裁剪干净图形,并验证图片质量。支持学术新闻稿、论文写作等场景的自动化图片处理。

SKILL.md

name
pdf-figure-extractor
description
从PDF论文中精确提取Figure图片,自动分析PDF结构、定位caption位置、裁剪干净图形,并验证图片质量。支持学术新闻稿、论文写作等场景的自动化图片处理。

PDF Figure提取技能

使用场景

  • 从学术论文PDF提取Figure插入Word文档
  • 需要干净、无caption、无正文的纯图形图片
  • 批量提取多个Figure

标准工作流程

步骤1: 分析PDF结构

import fitz

doc = fitz.open(pdf_path)
page = doc[page_num]

# 获取所有文本块
blocks = page.get_text("blocks")
for block in blocks:
    x0, y0, x1, y1, text, block_no, block_type = block
    if "Fig." in text or "Figure" in text:
        print(f"Figure相关: y={y0:.0f}-{y1:.0f}, {text[:50]}...")

步骤2: 定位Caption位置

# 搜索Fig. X的精确位置
text_instances = page.search_for(f"Fig. {fig_num}")
for inst in text_instances:
    print(f"Fig.{fig_num}位置: y={inst.y0:.0f}-{inst.y1:.0f}")

步骤3: 确定裁剪区域

根据caption位置判断图形区域:

Caption位置图形区域
y=400 (页面中部)y=100-395 (caption上方)
y=666 (页面底部)y=350-660 (caption上方)
y=326 (页面底部)y=100-320 (caption上方)

步骤4: 精确裁剪

rect = fitz.Rect(50, y_start, page.rect.width - 50, y_end)
pix = page.get_pixmap(matrix=fitz.Matrix(2, 2), clip=rect)
pix.save(f"fig{fig_num}.png")

步骤5: 验证图片质量

检查清单:

  • [ ] 包含所有子图(a,b,c,d...)
  • [ ] 没有混入"Fig. X"开头的caption文字
  • [ ] 没有混入正文段落
  • [ ] 坐标轴和标签完整

常见PDF布局模板

Nature/Science论文

  • Fig.1: 通常caption在底部,图形y=350-660
  • Fig.2+: caption位置不固定,需要先分析

会议论文

  • 单栏布局: caption通常在图形下方
  • 双栏布局: caption可能在图形上方或下方

错误处理

问题: 图片混入正文

原因: 裁剪范围太大 解决: 缩小y_end,确保在caption之前结束

问题: 子图缺失

原因: 裁剪范围太小 解决: 扩大y_start/y_end,包含完整图形

问题: caption未去除

原因: 裁剪范围包含了caption区域 解决: 根据caption的y坐标精确调整裁剪边界

最佳实践

  1. 永远不要凭感觉估计坐标
  2. 始终先分析PDF文本块结构
  3. 高分辨率渲染: 使用matrix=fitz.Matrix(2, 2)
  4. 验证每张图片: 确保干净无杂质
  5. 记录坐标: 为常见PDF类型建立坐标模板

触发关键词

"提取PDF图片", "从PDF提取Figure", "PDF图片裁剪", "学术论文图片提取"

适合场景

01

OpenClaw 用户查找和安装 Skill 时

02

用户想查找某类 Agent Skill 时

03

需要根据任务场景推荐可安装能力包时

04

需要对比不同来源的安装命令和来源信息时

能力概览

能力 1

按任务关键词查找相关 Skills

能力 2

展示可复制的安装命令

能力 3

保留来源站点、仓库和原始说明,方便继续核验

能力 4

补充不同宿主或平台的使用分布数据

能力 5

展示第三方安全扫描或审计结果

安装后应在对应宿主中按原始 README 的触发条件使用;具体调用方式请以来源页面和 README 为准。

平台分布

OpenClaw

76.34%
按下载量换算1,757

安全审计

VirusTotal

通过

ClawScan

通过

Static analysis

通过

权限和风险

权限需确认

当前来源未能明确判断权限范围,默认进入异常复核队列。

安装前确认

本站仅展示第三方公开信息,不托管安装包,不提供自动安装或运行环境。安装前应自行审查源码、依赖和命令行为。当前只有一个来源,正式发布前建议补源仓库或其他目录站核验。

来源信息

继续浏览同类 Skills