mcp arxiv服务器
MCP(模型上下文协议)服务器,为LLM提供对arXiv研究论文的全面访问。直接从您的AI助手搜索、阅读、分析和比较学术论文。
特性
- 搜索论文 按主题、作者、类别或日期范围
- 获取完整元数据 包括摘要、作者和类别
- 下载并解析PDF 提取全文内容
- 摘录引文 来自纸质参考书目
- 查找相关论文 基于内容相似性
- 作者搜索 先按最新提交的内容排序
- 纸张比较 并排分析多篇论文
- 结构化摘要 人工智能辅助分析
- 资源 按类别浏览最新论文(最新论文优先)
- 可靠的API访问 具有状态检查、超时处理和瞬态故障重试功能
安装
使用npx(推荐)
npx mcp-arxiv-server全球安装
npm install -g mcp-arxiv-server来源
git clone
cd mcp-arxiv-server
npm install
npm run build
npm start在本地运行
cd mcp-arxiv-server
npm install
npm run build
npm start服务器运行在 stdio 并应记录:
arXiv MCP Server running on stdio开发命令
# Watch TypeScript changes
npm run dev
# Build once
npm run build
# Start compiled server
npm start
# Run tests
npm testClaude桌面配置
将此添加到您的Claude Desktop配置文件中:
macOS: ~/Library/Application Support/Claude/claude_desktop_config.json 视窗: %APPDATA%\Claude\claude_desktop_config.json
{
"mcpServers": {
"arxiv": {
"command": "npx",
"args": ["mcp-arxiv-server"]
}
}
}或者,如果全局安装:
{
"mcpServers": {
"arxiv": {
"command": "mcp-arxiv-server"
}
}
}可用工具
1.搜索路径
使用灵活的查询语法在arXiv中搜索论文。
参数:
query(字符串,必填):搜索查询。支持arXiv语法:
- ti:transformer -在标题中搜索 - au:vaswani -按作者搜索 - cat:cs.AI -按类别搜索 - abs:attention -在摘要中搜索
max_results(数字,默认值:10):返回的最大结果start(数字,默认值:0):分页的起始索引
例子:
Search for recent papers on transformers in NLP
→ search_papers(query="ti:transformer cat:cs.CL", max_results=5)2.价格
获取特定论文的完整元数据。
参数:
arxiv_id(字符串,必填):arXiv纸张ID(例如,“2301.07041”)
例子:
Get details for paper 2301.07041
→ get_paper(arxiv_id="2301.07041")3.get_paper_pdf_text
下载并从论文的PDF中提取全文。
参数:
arxiv_id(字符串,必填):arXiv纸张IDchunk_index(数字,默认值:0):对于大型论文,要检索哪个块
例子:
Read the full text of paper 2301.07041
→ get_paper_pdf_text(arxiv_id="2301.07041")4.搜索_作者
查找特定作者的所有论文,最新论文优先。
参数:
author(字符串,必填):作者姓名(例如“Yoshua Bengio”)max_results(数字,默认值:20):最大结果
例子:
Find papers by Geoffrey Hinton
→ search_by_author(author="Geoffrey Hinton", max_results=10)5.定量分析
从论文的参考书目中提取参考文献。
参数:
arxiv_id(字符串,必填):arXiv纸张ID
例子:
Get all citations from paper 2301.07041
→ get_citations(arxiv_id="2301.07041")6.获取相关论文
查找与给定论文相关的论文。
参数:
arxiv_id(字符串,必填):arXiv纸张IDmax_results(数字,默认值:10):最大结果
例子:
Find papers related to 2301.07041
→ get_related_papers(arxiv_id="2301.07041", max_results=5)7.总结
使论文内容结构化,以便进行人工智能摘要。
参数:
arxiv_id(字符串,必填):arXiv纸张IDinclude_full_text(布尔值,默认值:false):包含完整的PDF文本
例子:
Summarize paper 2301.07041
→ summarize_paper(arxiv_id="2301.07041", include_full_text=true)8.比较文件
获取多篇论文进行并排比较。
参数:
arxiv_ids(数组,必填):2-3arXiv纸张ID
例子:
Compare these three papers on attention mechanisms
→ compare_papers(arxiv_ids=["1706.03762", "2010.11929", "2301.07041"])可用资源
资源提供对纸质收藏的结构化访问:
arxiv://recent/cs.AI-最近的AI论文arxiv://recent/cs.LG-最近的机器学习论文arxiv://recent/cs.CL-最近的计算和语言论文arxiv://paper/{id}-特定论文的完整细节
对话示例
文献综述
User: Find recent papers on large language models
Assistant: [Uses search_papers with query="ti:large language model cat:cs.CL"]
User: Get more details on the first paper
Assistant: [Uses get_paper with the arxiv_id]
User: What papers does it cite?
Assistant: [Uses get_citations to extract bibliography]
User: Find related work
Assistant: [Uses get_related_papers]作者研究
User: Show me Yann LeCun's recent papers
Assistant: [Uses search_by_author with author="Yann LeCun"]
User: Summarize his most recent paper
Assistant: [Uses summarize_paper with include_full_text=true]纸张比较
User: Compare the original Transformer paper with BERT and GPT-2
Assistant: [Uses compare_papers with arxiv_ids for all three papers]
[Analyzes and creates comparison table of architectures, training methods, and results]深入探究
User: I want to read the full text of paper 2301.07041
Assistant: [Uses get_paper_pdf_text to extract PDF content]
User: What are the key contributions?
Assistant: [Analyzes the extracted text to identify main contributions]特性
- 速率限制:尊重arXiv在请求之间的3秒速率限制
- 缓存:30分钟内存缓存,以避免重复的API调用
- PDF解析:从PDF中自动提取文本,并对大型论文进行分块
- 灵活搜索:完全支持arXiv的查询语法
- 错误处理:HTTP状态验证加上暂时API失败的超时/重试
- 相关论文过滤:即使arXiv ID版本不同,也不包括源论文
arXiv分类
您可以搜索的常见类别:
cs.AI-人工智能cs.LG-机器学习cs.CL-计算与语言(NLP)cs.CV-计算机视觉cs.NE-神经与进化计算stat.ML-机器学习(统计学)
许可证
MIT许可证
贡献
欢迎投稿!请随时提交问题或拉取请求。
致谢
内置:
- @模型上下文协议/sdk -MCP TypeScript SDK
- 快速xml解析器 -XML解析
- pdf解析 -PDF文本提取
