Token导航 LogoToken导航TokenDH.com
效率权限需确认clawhub未标认证来源可访问clear审计通过

document-reader文件阅读器

Agent Skill

document-reader 用于整理文档、README、Markdown 和说明材料,适合在 OpenClaw 中需要把零散信息整理成结构清晰的文档时使用。可结合来源仓库、安装命令和原始 README 继续核验具体用法。安装前建议确认权限范围、维护状态,以及是否会触发联网、命令执行或文件读写。

总安装

8,101

周安装

348

GitHub Stars

公开资料未说明

下载量

2,840
OpenClaw

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

GitHub

来源数

2

许可证

MIT-0

最后核验

2026-05-01

来源状态

来源可访问

安装方式

通过对话安装

复制提示词发给支持本地命令或 Skills 的 AI 助手,先确认命令和权限,再让它执行。

请帮我安装这个 Agent Skill:document-reader(文件阅读器)
来源仓库:https://github.com/xiaoyaliu00/document-reader
安装命令:
openclaw skills install document-reader
安装前请先检查当前环境是否支持对应 CLI,并向我确认将要执行的命令、安装目录、联网范围和文件读写权限;确认后再执行。

命令行安装

复制命令到本机终端执行。该命令会通过 OpenClaw 从第三方来源获取 Skill;本站只展示命令,不托管安装包,也不自动执行。

ClawHubOpenClaw
openclaw skills install document-reader

简介

通用文档读取工具,支持 PDF/DOCX/XLSX/PPTX/RTF/ODT 等多种文档格式,也支持 ZIP/TAR.GZ/RAR/7Z 等主流压缩包内文档直接读取

SKILL.md

name
document-reader
description
通用文档读取工具,支持 PDF/DOCX/XLSX/PPTX/RTF/ODT 等多种文档格式,也支持 ZIP/TAR.GZ/RAR/7Z 等主流压缩包内文档直接读取
version
1.0.0

Document Reader - 通用文档读取技能

读取各种格式文档的内容,直接输出文本供 AI 分析。支持压缩包内文档直接读取,无需手动解压。

📦 支持格式

文档

格式扩展名说明
PDF.pdf支持文本提取,依赖 poppler-utils
Microsoft Word.docx完整提取所有段落文本
Microsoft Excel.xlsx按 Sheet 输出,每个 Sheet 输出为表格文本
Microsoft PowerPoint.pptx按 Slide 分块输出
Rich Text Format.rtf
OpenDocument Text.odt
HTML.html/.htm提取正文文本
纯文本.txt/.md/.json/.xml/.py/.js直接读取

压缩包

格式扩展名功能
ZIP.zip列出文件 ➜ 读取指定文档
TAR.tar/.tar.gz/.tgz/.tar.bz2列出文件 ➜ 读取指定文档
RAR.rar列出文件 ➜ 读取指定文档
7-Zip.7z列出文件 ➜ 读取指定文档

🚀 快速开始

依赖安装

Python 包:

pip install textract python-docx openpyxl python-pptx rarfile py7zr --break-system-packages

系统依赖(Ubuntu/Debian):

apt-get install -y poppler-utils antiword unrtf tidy libxml2-dev libxslt1-dev

💡 使用示例

1. 直接读取本地文档

# 读取 PDF 文件
python {baseDir}/scripts/document_reader.py --file /path/to/document.pdf

# 读取 Word 文档
python {baseDir}/scripts/document_reader.py --file /path/to/report.docx

# 读取 Excel 文件(输出带 Sheet 分隔的表格文本)
python {baseDir}/scripts/document_reader.py --file /path/to/data.xlsx

# JSON 格式输出(方便程序处理)
python {baseDir}/scripts/document_reader.py --file /path/to/data.xlsx --format json

2. 处理压缩包

先列出压缩包里有哪些文件:

# 列出 ZIP 包内容
python {baseDir}/scripts/document_reader.py --list /path/to/archive.zip

# 列出 RAR 包内容
python {baseDir}/scripts/document_reader.py --list /path/to/archive.rar

# 列出 7z 包内容
python {baseDir}/scripts/document_reader.py --list /path/to/archive.7z

读取压缩包里的指定文档:

# 读取 ZIP 包内的 Word 文档
python {baseDir}/scripts/document_reader.py --file /path/to/archive.zip --inner-path document.docx

# 读取 7z 包内的 PDF
python {baseDir}/scripts/document_reader.py --file /path/to/archive.7z --inner-path report.pdf

输出示例

读取文档:

=== report.pdf ===

# 项目进度报告

## 本周完成

1. 完成了前端界面开发
2. 修复了三个 Bug
3. 编写了接口文档

...

列出压缩包:

Archive: data.zip
Found 3 file(s):

  readme.txt
  docs/report.pdf
  data/sheet.xlsx

✨ 特性

  • 🎯 开箱即用 — 装完依赖直接用,无需复杂配置
  • 📦 支持压缩包 — 不用手动解压,直接列出并读取内部文件
  • 🔍 模糊匹配 — 大小写不敏感匹配文件名,找不到精确匹配时自动尝试
  • 🎨 多种输出格式 — 人类可读文本 / JSON 程序接口都支持
  • 🧩 完整支持所有常用格式 — 办公文档+压缩包全覆盖

📝 使用场景

  • AI 分析各种办公文档
  • 批量读取压缩包内的文档内容
  • 快速查看附件内容
  • 数据提取和预处理

作者

Created by xiaoya Liu with OpenClaw

适合场景

01

OpenClaw 用户查找和安装 Skill 时

02

用户想查找某类 Agent Skill 时

03

需要根据任务场景推荐可安装能力包时

04

需要对比不同来源的安装命令和来源信息时

能力概览

能力 1

按任务关键词查找相关 Skills

能力 2

展示可复制的安装命令

能力 3

保留来源站点、仓库和原始说明,方便继续核验

能力 4

补充不同宿主或平台的使用分布数据

能力 5

展示第三方安全扫描或审计结果

安装后应在对应宿主中按原始 README 的触发条件使用;具体调用方式请以来源页面和 README 为准。

平台分布

OpenClaw

72.59%
按下载量换算2,062

安全审计

VirusTotal

通过

ClawScan

通过

Static analysis

通过

权限和风险

权限需确认

当前来源未能明确判断权限范围,默认进入异常复核队列。

安装前确认

本站仅展示第三方公开信息,不托管安装包,不提供自动安装或运行环境。安装前应自行审查源码、依赖和命令行为。当前只有一个来源,正式发布前建议补源仓库或其他目录站核验。

来源信息

继续浏览同类 Skills