poorman-rag:零基础架构无服务器MCP rag
波曼抹布 是一种高性能、经济高效的检索增强生成(RAG)实现,旨在完全在 AWS Lambda 和 第3页。它原生支持 模型上下文协议(MCP),使其能够立即与Claude Desktop等AI代理和各种IDE扩展兼容。
🚀 为什么是破布?
- 零基础设施:不需要管理矢量数据库(Pinecone、Weaviate)。您的数据存储在S3中,计算发生在Lambda中。
- 疯狂的成本效益:只为你使用的东西付费。非常适合中小型知识库,其中每月50美元的矢量数据库过于昂贵。
- 混合搜索联合 向量搜索 (语义)with SQLite FTS5 (关键字)使用 互易秩融合(RRF) 以获得卓越的结果质量。
- 快速燃烧:搜索引擎是用 去 使用
usearch和onnxruntime用于局部嵌入推理和向量匹配。 - 协议本机:从头开始构建以支持MCP,允许任何AI工具作为一组工具查询您的知识库。
🏗️ 建筑
- 索引器(Python):处理原始数据,生成嵌入,并构建一个紧凑的SQLite+Usearch索引。
- S3存储:存储压缩的索引文件和模型权重。
- MCP服务器(Go):一个Lambda函数,它从S3延迟加载索引,执行混合搜索,并通过MCP进行通信。
🛠️ 快速开始
1.先决条件
- AWS CLI已配置
- 已安装无服务器框架(
npm install -g serverless) - 转到1.21+(用于构建服务器)
- Python 3.10+(用于索引)
2.索引您的数据
使用中提供的Python脚本准备数据 indexer/ 目录。
# Install dependencies
pip install -r indexer/requirements.txt
# Run the indexer (see docs/indexer.md for details)
python indexer/your_indexer.py index3.部署到AWS
# Build the Go binary
GOOS=linux GOARCH=amd64 go build -o bootstrap cmd/mcp/main.go
zip deployment.zip bootstrap lib/libonnxruntime.so
# Deploy using Serverless
export RAG_BUCKET=your-bucket-name
export RAG_KB_ALIASES=docs
sls deploy📜 文档
🤝 贡献
我们欢迎捐款!请查看我们的路线图和未决问题。
⚖️ 许可证
MIT许可证。看 许可证 了解详情。
