MCP MinerU
](https://pypi.org/project/mcp-mineru/)  
用于文档和图像解析的MCP服务器 矿工。在Apple Silicon上使用MLX加速从PDF、屏幕截图和扫描文档中提取文本、表格和公式。
安装
claude mcp add --transport stdio --scope user mineru -- \
uvx --from mcp-mineru python -m mcp_mineru.server此命令使用以下命令为所有Claude Code项目安装和配置服务器 uvx (无需手动安装)。
替代方法:参见 安装指南 用于PyPI、源代码安装和Claude Desktop配置。
特性
- 支持多种格式:PDF、JPEG、PNG和其他图像格式
- OCR功能:从屏幕截图和照片中提取内置文本
- 表格识别:提取表时保留结构
- 公式抽取:将数学方程式转换为LaTeX
- MLX加速:针对苹果硅(M1/M2/M3/M4)进行了优化
- 多个后端:选择速度与质量的权衡
快速开始
解析PDF文档
User: "Analyze the tables in research_paper.pdf"
Claude: [Calls parse_pdf tool] "The paper contains 3 tables..."从屏幕截图中提取文本
User: "What does this screenshot say? image.png"
Claude: [Calls parse_pdf tool] "The screenshot contains..."检查系统功能
User: "Which backend should I use?"
Claude: [Calls list_backends tool] "Your system has Apple Silicon M4..."有关更多示例,请参见 用法示例.
工具
parse_pdf
解析PDF和图像文件,提取结构化内容作为Markdown。
参数:
file_path(必填):文件的绝对路径(PDF、JPEG、PNG等)backend(可选):pipeline|vlm-mlx-engine|vlm-transformersformula_enable(可选):启用公式识别(默认值:true)table_enable(可选):启用表格识别(默认值:true)start_page(可选):PDF的起始页(默认值:0)end_page(可选):PDF的结束页(默认值:-1)
list_backends
检查系统功能并获取后端建议。
退货: 系统信息、可用后端和性能建议。
支持格式
- PDF文档(.PDF)
- JPEG图像(.jpg、.JPEG)
- PNG图像(.PNG)
- 其他图像格式(WebP、GIF等)
演出
以苹果Silicon M4(16GB RAM)为基准:
- 管道:约32s/页,仅CPU,质量好
- vlm-mlx发动机:约38秒/页,苹果硅优化,品质卓越
- vlm变压器:约148秒/页,最高质量,最慢
文档
发展
git clone https://github.com/TINKPA/mcp-mineru.git
cd mcp-mineru
uv pip install -e ".[dev]"
# Run tests
pytest
# Format code
black src/
ruff check src/许可证
Apache许可证2.0-请参阅 许可证 文件以获取详细信息。
致谢
建在上面 矿工 由OpenDataLab提供。
