Papertrail
使用Claude Code管理学术论文库的MCP服务器。搜索论文,下载并将其转换为markdown,生成结构化摘要,并在整个库中搜索。
它做什么
- 查找文件 通过语义学者、arXiv和SSRN
- 下载并转换 将PDF转换为可搜索的标记(pymupdf4llm)
- 生成摘要 具有节级详细信息、关键结果、表格和图形
- 管理标签 随着词汇量的增长,分类更加一致
- 全文搜索 元数据、摘要和论文内容(SQLite FTS5)
- 跨机器同步 通过rclone(S3、Wasabi、谷歌云、Backblaze、Dropbox和 40+其他后端)
- 文献综述 使用并行子代理跨多篇论文
安装
第一步:安装uv
紫外线 是一个快速的Python包管理器。如果你没有:
# macOS / Linux
curl -LsSf https://astral.sh/uv/install.sh | sh
# Or with Homebrew
brew install uv步骤2:克隆仓库和安装技能
git clone https://github.com/YOURUSER/papertrail.git
cd papertrail
# Copy the skills into your Claude Code config directory.
# Skills are slash commands (/add-paper, /search-papers, etc.) that
# tell Claude how to use papertrail step by step.
mkdir -p ~/.claude/skills
cp -r skills/* ~/.claude/skills/步骤3:将MCP服务器添加到Claude Code
Claude Code使用MCP(模型上下文协议)服务器为Claude提供访问权限 外部工具。你需要告诉克劳德·科德在哪里可以找到蛛丝马迹。
打开(或创建) ~/.claude.json 并添加以下内容。替换 /path/to/papertrail 使用克隆仓库的实际路径:
{
"mcpServers": {
"papertrail": {
"command": "uv",
"args": ["--directory", "/path/to/papertrail", "run", "papertrail"],
"env": {
"PAPERTRAIL_DATA_DIR": "${HOME}/.papertrail",
"PAPERTRAIL_RCLONE_REMOTE": ""
}
}
}
}重新启动Claude代码(或运行 /mcp 重新加载服务器)。你应该看看 papertrail的工具变得可用。
至此,您就完成了——papertrail将在本地存储所有内容 ~/.papertrail/。如果要跨机器同步,请继续执行步骤4。
步骤4:使用rclone设置云同步(可选)
rclone 将您的库同步到云存储(S3,Wasabi, 谷歌云、Backblaze、Dropbox等),因此它在机器之间保持一致。 启动时,papertrail将远程状态拉到 ~/.papertrail/.每次之后 写(摄取论文、存储摘要、标记),它会推动更改 文件返回。无需安装保险丝。
4a。安装rclone
# macOS
brew install rclone
# Linux
sudo apt install rclone # Debian/Ubuntu
# Or: curl https://rclone.org/install.sh | sudo bash4b。配置遥控器
跑 rclone config 并按照交互式提示连接存储 供应商。这将创建一个稍后将引用的命名远程。看 rclone的提供商列表 有关的设置指南 每个后端。
rclone config
# Example: create a remote named "myremote" pointing to an S3-compatible bucket4c。创建bucket并更新配置
# Create the bucket on your remote
rclone mkdir myremote:my-papertrail-bucket
# Then update PAPERTRAIL_RCLONE_REMOTE in your ~/.claude.json:
# "PAPERTRAIL_RCLONE_REMOTE": "myremote:my-papertrail-bucket"重新启动克劳德代码。启动时,papertrail会将远程存储桶同步到 ~/.papertrail 并重建搜索索引。在会话期间,它会定期 重新同步以获取在其他计算机上所做的更改。
用法
技能(斜线命令)
/add-paper --向库中添加一篇论文。接受:
- arXiv ID:
/add-paper 2301.12345 - DOI:
/add-paper 10.1257/aer.2024.001 - SSRN网址:
/add-paper https://ssrn.com/abstract=1234567 - 标题搜索:
/add-paper "Causal Inference in Economics" - 作者+标题:
/add-paper Cunningham and Shah decriminalization - 本地PDF:
/add-paper ~/Downloads/paper.pdf
运行完整的管道:查找、下载、转换为markdown、生成结构化摘要、分配标签和存储。使用子代理读取和总结论文,同时进行标签提取。
/search-papers --按主题、作者、方法或关键字搜索您的库。
/read-paper --阅读一篇论文的摘要,并将相关部分纳入上下文。
/lit-review --对图书馆的论文进行文献综述。查找相关论文,通过子代理并行阅读所有论文,并将研究结果与跨论文比较、主题分组和引用进行综合。
MCP工具(直接提供给Claude)
| 工具 | 目的 |
|---|---|
find_paper | 在Semantic Scholars/arXiv上搜索论文 |
ingest_paper | 下载并开始转换论文 |
ingest_paper_manual | 为自动下载失败的论文提供PDF |
conversion_status | 检查PDF到markdown的转换进度 |
read_paper | 阅读纸张标记(全范围或行范围) |
store_summary | 存储生成的摘要 |
search_library | 搜索元数据、主题、关键字、摘要 |
search_paper_text | 对论文内容进行全文搜索 |
get_paper_metadata | 获取论文的元数据+摘要 |
list_papers | 浏览库,按状态或标签筛选 |
list_tags | 查看标签词汇表 |
add_tags | 在词汇表中添加新标签 |
tag_paper | 标记纸张 |
delete_paper | 从库中取出一张纸 |
rebuild_index | 强制进行完全重新扫描和索引重建 |
配置
| 环境变量 | 默认值 | 描述 |
|---|---|---|
PAPERTRAIL_DATA_DIR | ~/.papertrail | 本地数据目录(如果已配置,则从远程同步) |
PAPERTRAIL_RCLONE_REMOTE | (空) | r单独的远程路径(例如。, myremote:my-bucket) |
PAPERTRAIL_INDEX_DIR | ~/.cache/papertrail | 临时搜索索引的本地目录 |
PAPERTRAIL_SEMANTIC_SCHOLAR_API_KEY | (none) | 用于更高速率限制的可选API键 |
PAPERTRAIL_HTTP_PROXY | (无) | PDF下载的HTTP代理 |
PAPERTRAIL_UNPAYWALL_EMAIL | (none) | Unpaywallneneneba API的电子邮件(查找合法的开放访问PDF) |
访问付费墙文件
- 在VPN上:通过DOI链接下载PDF会自动工作——出版商会看到您的机构IP。
- 关闭VPN:设置
PAPERTRAIL_HTTP_PROXY将PDF下载路由到您机构的代理URL。 - 未付费墙:设置
PAPERTRAIL_UNPAYWALL_EMAIL到任何电子邮件地址,以启用Unpaywallneneneba API,该API可查找文件的合法开放访问副本。不需要API密钥。
