一个基于Model Context Protocol (MCP)的PDF文本提取服务器,提供文本内容提取、表格提取和PDF基本信息获取功能。
安装状态
已补齐
工具数量
3
GitHub Stars
1
命令预览
uvx --from git+https://github.com/gstiebler/pdf-mcp-server.git pdf-mcp-server
一个基于Model Context Protocol (MCP)的PDF文本提取服务器,提供文本内容提取、表格提取和PDF基本信息获取功能。
安装状态
已补齐
工具数量
3
GitHub Stars
1
命令预览
uvx --from git+https://github.com/gstiebler/pdf-mcp-server.git pdf-mcp-server

@fabriqa.ai/pdf-reader-mcp/update-config.js
一个高效的PDF文本提取服务,支持读取、搜索和提取PDF文件中的文本和元数据,优化了Claude Code的上下文窗口使用。
安装状态
已补齐
工具数量
3
GitHub Stars
1
命令预览
npx @fabriqa.ai/pdf-reader-mcp/update-config.js
Visara是一款符合Model Context Protocol(MCP)标准的视觉分析服务器,提供图像处理、文本提取和场景理解功能,支持前端开发工作流程。
工具数量
1
GitHub Stars
1
AI Invoice Insights是一款多代理发票智能解析产品,提供发票上传、文本提取、多代理处理和结果验证功能,适用于财务文档处理场景。
工具数量
0
GitHub Stars
0
一个用于从PDF、DOCX、DOC、PPTX、ODT和TXT等文档中提取文本内容的工具,支持本地文件、URL和Base64编码数据的处理。
工具数量
3
GitHub Stars
0

aparavi-mcp@latest
Aparavi MCP服务器是一个集成了Aparavi文档处理能力的模型上下文协议服务器,允许语言模型通过API处理文档并获取清理后的文本输出。
安装状态
已补齐
工具数量
2
GitHub Stars
0
命令预览
npx aparavi-mcp@latest
一个用于创建Model Context Protocol (MCP)服务器自定义工具的Python工具集,支持本地开源模型如LmStudio和Ollama,提供PDF处理、文本提取等功能。
安装状态
已补齐
工具数量
0
GitHub Stars
0
命令预览
docker run --rm -i \
HULFT MCP Server 是一个基于AWS AI服务的文档处理服务器,提供文本提取、文档分类、字段提取等功能。
安装状态
已补齐
工具数量
11
GitHub Stars
0
命令预览
pip install pre-commit
一个通用的MCP服务器,用于处理PDF文档中的文本内容,提取文本并分块,转换为带有LaTeX支持的Markdown格式。
安装状态
已补齐
工具数量
0
GitHub Stars
0
命令预览
uv run python run.py --transport sse
一个基于自然语言命令控制浏览器的代理工具,支持多步骤任务、自动搜索、点击、滚动、截图、文本提取和总结等功能。
安装状态
已补齐
工具数量
0
GitHub Stars
0
命令预览
python3 -m venv venv
一个基于Django的聊天应用,支持文档上传并与AI代理进行交互,利用文档内容回答问题。
工具数量
0
GitHub Stars
0
一个基于Rust的CLI工具,用于处理HWP/HWPX文档,包括文本提取、元数据检查、文档转换等功能。
工具数量
8
GitHub Stars
0

mistral-ocr-mcp
Mistral OCR MCP服务器是一个基于Node.js/TypeScript的PDF OCR处理工具,支持从本地PDF、URL和图像中提取文本、表格和结构化数据,优化多语言文档处理。
安装状态
已补齐
工具数量
6
GitHub Stars
0
命令预览
npx mistral-ocr-mcp
MCP PDF Reader是一个基于MCP协议的PDF操作服务,提供文本提取、OCR识别和图像处理等功能,适用于需要批量处理PDF文档的场景。
工具数量
0
GitHub Stars
0
MCP服务器,用于从PDF文件中提取文本,并支持通过Tesseract OCR从嵌入的图像中提取文本。
安装状态
已补齐
工具数量
1
GitHub Stars
0
命令预览
python -m venv venv
一个基于Model Context Protocol (MCP)的PDF文档阅读和分析服务,支持在VS Code中查看、提取文本、生成摘要和分析PDF内容。
安装状态
已补齐
工具数量
0
GitHub Stars
0
命令预览
docker run --name pdf-reader-mcp -it pdf-reader-mcp
MCP PDF Reader Enhanced 是一个基于 Model Context Protocol (MCP) 的服务器,提供高级的 PDF 文本提取、搜索和分析功能。该服务支持从 PDF 文件中提取文本内容、搜索特定文本、提取元数据等功能,并具备文件大小限制、异步处理等特性。适用于需要处理和分析 PDF 文档的场景。
GitHub Stars
0
一个基于FastMCP的PDF文件阅读服务器,支持PDF文本提取、OCR识别和图像提取,提供内置的Web调试器以便测试。
安装状态
已补齐
工具数量
3
GitHub Stars
0
命令预览
pip install pymupdf mcp

@johangorter/mcp-pdf-server
一个基于Node.js的服务器,实现MCP协议,用于从PDF文件中提取纯文本,支持安全目录访问控制和字符限制。
安装状态
已补齐
工具数量
0
GitHub Stars
0
命令预览
npx @johangorter/mcp-pdf-server /path/to/documents /path/to/pdfs
一个基于Python构建的OCR(光学字符识别)服务,通过本地PaddleOCR服务从复杂图像和PDF中提取文本和布局,支持多语言文本识别。
工具数量
3
GitHub Stars
0