一个基于FastAPI的PDF图表和表格提取服务,适用于学术研究、机器学习数据集创建和临床研究数据挖掘。
安装状态
已补齐
工具数量
1
GitHub Stars
7
命令预览
docker run -d -p 5001:5001 pdffigures2
一个基于FastAPI的PDF图表和表格提取服务,适用于学术研究、机器学习数据集创建和临床研究数据挖掘。
安装状态
已补齐
工具数量
1
GitHub Stars
7
命令预览
docker run -d -p 5001:5001 pdffigures2

@modelcontextprotocol/inspector
mcp-rag-server是一个轻量级的检索增强生成助手,可集成到任何支持模型上下文协议(MCP)的客户端中,用于索引存储库内容、构建嵌入并进行语义搜索。
安装状态
已补齐
工具数量
3
GitHub Stars
6
命令预览
npx @modelcontextprotocol/inspector node dist/index.js
基于Pinecone的RAG服务器,支持大规模PDF文档处理、评估管道和AI教学工具,适用于Claude Desktop。
安装状态
已补齐
工具数量
0
GitHub Stars
4
命令预览
uv run fastmcp install claude-desktop main.py
一个用于从PDF文件中提取图片的模型上下文协议(MCP)服务器,允许LLMs访问和分析本地PDF文档中的嵌入图片。
安装状态
已补齐
工具数量
0
GitHub Stars
3
命令预览
uvx pdf-image-extractor-mcp@latest
一个基于MCP服务器和Chroma向量数据库的PDF检索增强生成系统,允许Claude查询大型PDF文件中的信息。
安装状态
已补齐
工具数量
0
GitHub Stars
2
命令预览
python3 -m pip install chromadb
OCR.space MCP Server是一个用于从图像和PDF中提取文本的OCR服务,支持多种语言、自动处理大文件和多种输出格式。
安装状态
已补齐
工具数量
6
GitHub Stars
2
命令预览
pip install -e .
Spire.PDF MCP Server 是一个通过AI代理创建、读取、编辑和转换PDF文档的服务,无需依赖Adobe Acrobat或其他PDF软件。
安装状态
已补齐
工具数量
15
GitHub Stars
2
命令预览
uv run spire-pdf-mcp-server
使用IBM Watsonx.ai和ChromaDB构建检索增强生成(RAG)服务器,通过MCP协议暴露服务,支持基于PDF文档的问答功能。
安装状态
已补齐
工具数量
1
GitHub Stars
2
命令预览
python -m venv .venv
基于FastAPI实现的文档问答系统,支持PDF和CSV文件上传、向量存储及自然语言查询。
安装状态
已补齐
工具数量
2
GitHub Stars
1
命令预览
pip install -r requirements.txt
Optical Context MCP是一款专为处理大型、视觉结构化的PDF文件设计的工具,通过OCR技术将PDF转换为可检索的密集PNG图像,适用于代理工作流程。
安装状态
已补齐
工具数量
3
GitHub Stars
1
命令预览
python -m pip install optical-context-mcp
一个基于MCP协议的PDF研究论文索引与语义搜索服务,支持AI代理自动下载、索引和搜索学术论文,适用于学术研究和知识管理。
安装状态
已补齐
工具数量
0
GitHub Stars
1
命令预览
python3 -m venv venv

mcp-pdf
一个为AI助手提供全面PDF操作能力的服务器,支持自然语言交互,包括编辑、表单填充、页面操作和安全工具等功能。
安装状态
已补齐
工具数量
0
GitHub Stars
1
命令预览
npx mcp-pdf --version
一个基于Model Context Protocol (MCP)的PDF文本提取服务器,提供文本内容提取、表格提取和PDF基本信息获取功能。
安装状态
已补齐
工具数量
3
GitHub Stars
1
命令预览
uvx --from git+https://github.com/gstiebler/pdf-mcp-server.git pdf-mcp-server
一个基于FastAPI后端的PDF检索增强生成(RAG)知识库处理系统,支持LanceDB向量搜索、SQLite元数据管理和Chakra UI仪表盘,适用于文档处理和知识管理场景。
安装状态
已补齐
工具数量
0
GitHub Stars
1
命令预览
python -m venv .venv

@fabriqa.ai/pdf-reader-mcp/update-config.js
一个高效的PDF文本提取服务,支持读取、搜索和提取PDF文件中的文本和元数据,优化了Claude Code的上下文窗口使用。
安装状态
已补齐
工具数量
3
GitHub Stars
1
命令预览
npx @fabriqa.ai/pdf-reader-mcp/update-config.js
一个提供PDF文件合并、拆分、压缩、转换等操作的MCP服务器,适用于AI助手进行PDF文档处理。
安装状态
已补齐
工具数量
10
GitHub Stars
1
命令预览
docker run -d \
TableShot是一款专为PDF表格提取设计的MCP服务器,无需编写代码即可为AI助手提供表格读取能力。
安装状态
已补齐
工具数量
2
GitHub Stars
1
命令预览
pip install tableshot
一个结合React前端和Python FastAPI后端的全栈Web应用,通过MCP-Agent实现智能文档检索与问答功能。
安装状态
已补齐
工具数量
0
GitHub Stars
0
命令预览
python -m venv .venv
一个完整的模型上下文协议(MCP)实现,提供与arXiv API交互的客户端和服务器,支持搜索、下载和文章内容提取功能。
安装状态
已补齐
工具数量
5
GitHub Stars
0
命令预览
python -m venv venv
一个基于MCP服务器的PDF处理工具,提供PDF到Markdown的转换及图像提取功能,适用于文档处理和内容管理场景。
安装状态
已补齐
工具数量
1
GitHub Stars
0
命令预览
python -m src.awels_mcp.run_server