Token导航 LogoToken导航TokenDH.com
图像处理权限需确认github未标认证来源可访问许可证需确认审计通过

document-image-extractor文档图像提取器

Agent Skill

用于辅助图像生成、图片编辑、视觉素材处理或图像模型工作流。它适合让 Agent 根据文本生成图片、处理背景、整理视觉提示词或调用相关图像工具。使用时需要确认输入图片、版权来源、输出格式和模型限制;涉及人物、品牌、商品或公开展示素材时,应额外核对授权、真实性和内容合规边界。

总安装

734

周安装

30

GitHub Stars

1

下载量

238
CodexClaudeCursorGemini CLI

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

GitHub

来源数

2

许可证

unknown

最后核验

2026-05-01

来源状态

来源可访问

安装方式

通过对话安装

复制提示词发给支持本地命令或 Skills 的 AI 助手,先确认命令和权限,再让它执行。

请帮我安装这个 Agent Skill:document-image-extractor(文档图像提取器)
来源仓库:https://github.com/mhliulgy/my-skills
仓库路径:skills/document-image-extractor
安装命令:
npx skills add https://github.com/mhliulgy/my-skills --skill document-image-extractor
安装前请先检查当前环境是否支持对应 CLI,并向我确认将要执行的命令、安装目录、联网范围和文件读写权限;确认后再执行。

命令行安装

复制命令到本机终端执行。该命令会通过 npx skills 从第三方来源获取 Skill;本站只展示命令,不托管安装包,也不自动执行。

skills.shnpx skills
npx skills add https://github.com/mhliulgy/my-skills --skill document-image-extractor

简介

从 Word 和 PDF 文档中提取图片的专用工具。

  • 适用于批量导出文档插图、整理视觉素材或支持图像模型训练。
  • 通过命令行指定输入文件与输出目录,可配置 DPI 和矢量图保留选项。
  • 需确保已安装 python-docx 和 pymupdf 依赖库方可正常运行。
  • document-image-extractor 属于图像处理类 Skill,可作为该场景下的辅助能力补充。

SKILL.md

Document Image Extractor

从 Word 和 PDF 文档中提取图片的 skill。

依赖安装

使用前需要安装依赖(默认用户已安装):

conda run -n claude-code pip install python-docx pymupdf

使用方法

基本命令

conda run -n claude-code python scripts/extract_images.py <文档路径> [-o <输出目录>]

参数说明

  • 文档路径:Word (.docx) 或 PDF (.pdf) 文件路径
  • -o, --output:输出目录(可选,默认在文档同目录创建 <文件名>_images 文件夹)
  • --dpi:PNG 转换 DPI(可选,默认 150,越高越清晰)
  • --keep-emf:保留原始 EMF/WMF 文件(Word 矢量图专用)
  • --convert-svg:将 EMF/WMF 转换为 SVG(Word 矢量图专用)

示例

# 从 Word 文档提取图片(默认只输出 PNG)
conda run -n claude-code python scripts/extract_images.py document.docx

# 提取图片并保留 EMF 源文件
conda run -n claude-code python scripts/extract_images.py document.docx --keep-emf

# 提取图片并转换为 SVG 格式
conda run -n claude-code python scripts/extract_images.py document.docx --convert-svg

# 提取图片并同时保留 EMF 和转换为 SVG
conda run -n claude-code python scripts/extract_images.py document.docx --keep-emf --convert-svg

# 指定更高 DPI 以获得更清晰的 PNG
conda run -n claude-code python scripts/extract_images.py document.docx --dpi 300

# 从 PDF 提取图片
conda run -n claude-code python scripts/extract_images.py document.pdf

# 指定输出目录
conda run -n claude-code python scripts/extract_images.py document.docx -o ./my_images

输出格式

  • 图片命名:image_001.png, image_002.jpg,...
  • PDF 图片会标注来源页面:image_001.png (page 1)

支持的图片格式

Word 文档

  • PNG, JPEG, JPG, GIF, BMP, TIFF, WebP, SVG
  • EMF/WMF 矢量图(可转换为 PNG/SVG)

PDF 文档

  • PNG, JPEG, JPG, GIF, BMP, TIFF
  • 注:PDF 矢量图形无法单独提取(PDF 内置为绘制指令,非独立对象)

注意事项

  • Word 文档:提取嵌入的图片、媒体文件和 SVG
  • PDF 文档:仅提取嵌入的位图图像
  • 如果文档中没有图片,将提示 "No images found"

适合场景

01

用户想查找某类 Agent Skill 时

02

需要根据任务场景推荐可安装能力包时

03

需要对比不同来源的安装命令和来源信息时

能力概览

能力 1

按任务关键词查找相关 Skills

能力 2

展示可复制的安装命令

能力 3

保留来源站点、仓库和原始说明,方便继续核验

能力 4

展示第三方安全扫描或审计结果

安装后应在对应宿主中按原始 README 的触发条件使用;具体调用方式请以来源页面和 README 为准。

平台分布

Codex

36.87%
按下载量换算88

Claude

27.86%
按下载量换算66

Cursor

20.11%
按下载量换算48

Gemini CLI

10.11%
按下载量换算24

安全审计

Gen Agent Trust Hub

通过

Socket

通过

Snyk

通过

权限和风险

权限需确认

当前来源未能明确判断权限范围,默认进入异常复核队列。

安装前确认

本站仅展示第三方公开信息,不托管安装包,不提供自动安装或运行环境。安装前应自行审查源码、依赖和命令行为。当前只有一个来源,正式发布前建议补源仓库或其他目录站核验。

来源信息

继续浏览同类 Skills