ArXiv Insight MCP服务器
一个智能模型上下文协议(MCP)服务器,使LLM能够搜索、阅读、分析和管理arXiv的学术论文。
特性
- 🔍 智能搜索:使用可选的类别过滤按主题搜索arXiv论文(例如。,
cs.AI,cs.CV). - 📖 全文访问:检索优化的论文全文。包括本地缓存,可在重复访问时提高10倍的速度。
- 📥 PDF下载:将原始PDF文件下载到本地计算机。 安全限制 到项目的下载目录。
- 📝 BibTeX生成:为您的论文生成标准BibTeX引用。
- ✂️ 剖面提取:巧妙地提取“引言”、“方法论”或“结论”等具体部分。
- 🔗 参考发现:自动检测并链接文本中引用的其他arXiv论文。
- 🛡️ 坚固且安全:实现速率限制、路径遍历保护和持久搜索历史记录。
先决条件
- Python 3.12+
- 紫外线 (建议用于依赖关系管理)
安装
- 克隆存储库:
git clone https://github.com/YI-TING-EE13/ArXiv-Insight-MCP-Server.git
cd ArXiv-Insight-MCP-Server- 安装依赖项:
uv sync用法
运行服务器
您可以直接使用以下命令运行服务器 uv:
uv run main.py使用MCP客户端进行配置(例如,Claude Desktop、LM Studio)
要将此服务器与MCP客户端一起使用,您需要将其添加到客户端的配置文件中(例如。, claude_desktop_config.json 或LM Studio的MCP设置)。
配置示例(JSON):
替换 C:\\Path\\To\\arxiv-insight-mcp 带有项目目录的绝对路径。
{
"mcpServers": {
"arxiv-insight": {
"command": "uv",
"args": [
"--directory",
"C:\\Path\\To\\ArXiv-Insight-MCP-Server",
"run",
"main.py"
]
}
}
}Windows用户注意事项: 确保使用双反睫毛 \\ 在路上。
可用工具
| 工具 | 说明 |
|---|---|
search_arxiv | 搜索论文。论据: topic, max_results (最大300), offset, category, sort_by, start_year, end_year. |
get_paper_fulltext | 获取论文的全文内容。 |
download_pdf | 下载PDF文件。论据: paper_id, save_dir. |
get_bibtex | 获取BibTeX引用字符串 |
extract_section | 从论文中提取特定部分。 |
提示
review_paper:生成一个深入的审查结构(贡献、方法、限制)。compare_papers:比较多篇论文的贡献和方法。
项目结构
main.py:服务器的入口点。arxiv_insight.py:主MCP服务器实现。paper_cache/:缓存解析后的纸质文本的目录(git忽略)。downloads/:下载PDF的默认目录(git忽略)。metadata_db.json:搜索历史和速率限制状态的持久存储(git忽略)。
