Token导航 LogoToken导航TokenDH.com
Pdf Downloader MCP logo
AI代理stdio官方级别未说明来源级核验

Pdf Downloader MCP

MCP Server

一个基于MCP协议的PDF下载工具,具有高级重试逻辑、错误处理和部分下载恢复功能。

工具数

1

提示词数

0

GitHub Stars

0

资源数

0
错误处理Python文件管理

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

作者 / 组织

baldawsari

提供方

baldawsari

最后核验

2026/5/17 20:22

快速接入

先看主来源和安装命令,再打开仓库或文档;下面只保留这个条目的关键接入事实。

命令预览

pip install -e .

详细介绍

PDF下载器MCP

一个强大的模型上下文协议(MCP)服务器,用于下载具有高级重试逻辑、错误处理和部分下载恢复的PDF文件。

特性

?核心功能

  • 单用途工具:一个工具(download_pdf)这使得PDF下载非常好
  • 稳健的重试逻辑:具有抖动的指数级回退,可优雅地处理网络问题
  • 部分下载恢复:使用HTTP范围请求恢复中断的下载
  • 全面的错误处理:对错误进行智能分类,以确定重试策略

?高级重试策略

指数退避

  • 第一次重试:等待5秒
  • 第二次重试:等待10秒
  • 第三次重试:等待20秒
  • 通过快速重试尝试防止服务器不堪重负

智能错误处理

  • 网络超时:重试,超时时间更长
  • HTTP 429(速率受限):等待更长时间,遵守费率限制
  • HTTP 503(服务器不可用):延迟后重试
  • HTTP 404/403:不要重试,立即返回错误
  • SSL/证书错误:使用不同的SSL设置重试

部分下载恢复

  • 使用HTTP范围请求恢复中断的下载
  • 检查服务器是否支持 Accept-Ranges: bytes
  • 从上次下载的字节位置恢复
  • 如果恢复失败,则回退到完整下载

下载验证

  • 验证文件大小是否匹配 Content-Length 头球
  • 基本PDF标题验证(从开始 %PDF)
  • 全面的PDF结构验证
  • 如果文件出现损坏,请重试

后备策略

  • 如果被阻止,请尝试其他用户代理字符串
  • 尝试使用/不使用SSL验证
  • 针对问题服务器的多种连接策略

安装

来源

git clone https://github.com/baldawsari/pdf-downloader-mcp.git
cd pdf-downloader-mcp
pip install -e .

开发安装

git clone https://github.com/baldawsari/pdf-downloader-mcp.git
cd pdf-downloader-mcp
pip install -e ".[dev]"

用法

作为MCP服务器

  1. 运行服务器:
pdf-downloader-mcp
  1. 或者作为Python模块运行:
python -m pdf_downloader_mcp

刀具参数

download_pdf 工具接受以下参数:

参数类型必填默认说明
url字符串-直接PDF URL
destination_path字符串-本地文件夹路径
filename字符串URL文件名自定义文件名
max_retries整数3重试次数(0-10)
retry_delay号码5.0重试之间的基本延迟(0.1-60.0s)
timeout号码30.0请求超时(5.0-300.0秒)

示例用法

{
  "tool": "download_pdf",
  "arguments": {
    "url": "https://example.com/document.pdf",
    "destination_path": "/home/user/downloads",
    "filename": "important_document.pdf",
    "max_retries": 5,
    "retry_delay": 10.0,
    "timeout": 60.0
  }
}

响应格式

成功响应

{
  "success": true,
  "local_path": "/home/user/downloads/important_document.pdf",
  "file_size": 1234567,
  "attempts_used": 2,
  "max_retries": 5,
  "download_time": 15.3,
  "total_time": 25.8,
  "average_speed": "4.85",
  "resumed": false,
  "bytes_downloaded": 1234567,
  "error_message": null
}

错误响应

{
  "success": false,
  "local_path": null,
  "file_size": 0,
  "attempts_used": 6,
  "max_retries": 5,
  "download_time": 0,
  "total_time": 45.2,
  "average_speed": "0.00",
  "resumed": false,
  "bytes_downloaded": 0,
  "error_message": "Failed after 6 attempts. Last error: HTTP 404: Not Found"
}

错误类别

下载器将错误分为三类,以获得最佳的重试行为:

重试错误

  • 网络超时
  • 服务器错误(5xx)
  • 费率限制(429)
  • 连接错误
  • SSL错误

NO_RETRY错误

  • 找不到文件(404)
  • 拒绝访问(403)
  • 错误请求(400)
  • 需要身份验证(401)

PARTIAL_RETRY错误

  • 下载不完整
  • 检测到损坏
  • 验证失败

配置

MCP服务器配置

添加到MCP配置文件中:

{
  "mcpServers": {
    "pdf-downloader": {
      "command": "pdf-downloader-mcp",
      "args": []
    }
  }
}

环境变量

变量描述默认值
PDF_DOWNLOADER_LOG_LEVEL日志记录级别(调试、信息、警告、错误)信息
PDF_DOWNLOADER_MAX_CONCURRENT最大并发下载量5

发展

运行测试

pytest

代码格式化

black src/ tests/
isort src/ tests/

类型检查

mypy src/

代码检查

flake8 src/ tests/

建筑

src/pdf_downloader_mcp/
??? __init__.py          # Package initialization
??? __main__.py          # CLI entry point
??? server.py            # MCP server implementation
??? downloader.py        # Core PDF downloader
??? exceptions.py        # Custom exception classes
??? validators.py        # PDF validation logic
??? utils.py            # Utility functions

贡献

  1. 分叉存储库
  2. 创建要素分支(git checkout -b feature/amazing-feature)
  3. 提交您的更改(git commit -m 'Add amazing feature')
  4. 推到分支(git push origin feature/amazing-feature)
  5. 打开拉取请求

许可证

此项目根据MIT许可证获得许可-请参阅 许可证 文件以获取详细信息。

致谢

______________________________________________________________________

用??用于可靠的PDF下载

目录标签

目录标签

错误处理Python文件管理PDF下载本地部署重试逻辑MCP协议

接入字段

传输方式(transport,传输协议)

stdio

鉴权方式(authType,认证方式)

none

工具数量(toolCount,工具数)

1

资源数量(resourceCount,资源数)

0

提示词数量(promptCount,提示词数)

0

权限和风险

stdionone部署方式未说明

接入前请确认传输方式、认证方式和部署位置,并根据实际工具能力限制访问范围。

安装前确认

不要直接授予不必要的文件、网络或账号权限;先核对安装命令和配置内容。

来源信息

继续浏览同类 MCP