通用文件读取器MCP
韩语
Universal File Reader是一个MCP服务器,用于从PDF、CSV、Excel和图像文件中提取文本和结构信息。服务器会自动选择合适的处理器,并在需要时回退到OCR。
安装
pip install -e .运行服务器
universal-file-reader通过SSH运行
您还可以通过SSH在远程计算机上运行服务器:
ssh user@remote-host universal-file-reader在Google的ADK中,此命令可用于 ToolSubprocess 向 与远程服务器通信。
服务器公开了三个工具: read_file, get_supported_formats 和 validate_file。参见 src/document_reader/mcp_server.py 了解详细的模式。
运行API服务器
您还可以启动一个封装相同功能的RESTneneneba API。该服务公开了三个端点:
POST /mcp–接受MCP JSON消息POST /upload–上传文件并接收服务器路径POST /test–上传文件并使用可选参数进行处理
在本地启动服务器:
universal-file-reader-api使用Docker Compose:
docker-compose upAPI将于 .
MCP消息格式
POST /mcp 需要一个具有以下结构的JSON正文:
{
"tool": "read_file",
"arguments": {
"file_path": "/path/to/file.pdf",
"output_format": "markdown"
}
}这 tool 字段对应于MCP工具之一(read_file, get_supported_formats,或 validate_file). arguments 包含 该工具的参数。
环境变量
MODEL_NAME–具有视觉功能的型号名称(例如。gpt-4o,gemini-2.0-flash)MODEL_API_KEY–所选模型的API密钥MAX_PAGE_PER_PROCESS–一个OCR批处理的PDF页面的最大数量。OCR_TIMEOUT_SECONDS–每个PDF页面的处理超时秒数(默认值30)TIMEOUT_SECONDS–全局处理超时EXTRACT_IMAGES–设置为时true,提取的PDF图像经过OCR处理并附加到输出中
运行测试
安装依赖项并运行测试套件:
pip install -r requirements.txt
pytest发展
pip install -e .[development]
ruff check