Token导航 LogoToken导航TokenDH.com
Pricescout MCP logo
浏览器工具stdio官方级别未说明来源级核验

Pricescout MCP

MCP Server

PriceScout MCP是一个基于AI和MCP协议的竞争对手价格智能分析系统,通过自动化网页抓取、数据提取和自然语言查询,实现实时市场分析。

工具数

0

提示词数

0

GitHub Stars

0

资源数

0
浏览器自动化Python网页抓取

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

作者 / 组织

kinshuk4

提供方

kinshuk4

最后核验

2026/5/17 20:21

运行时

Python

快速接入

先看主来源和安装命令,再打开仓库或文档;下面只保留这个条目的关键接入事实。

命令预览

python src/starter_client.py

详细介绍

PriceScout MCP

使用MCP(模型上下文协议)的AI驱动的竞争对手定价智能系统。自动网络抓取、数据提取和自然语言查询,用于实时市场分析。

![License: MIT](https://opensource.org/licenses/MIT) ![Python 3.10+](https://www.python.org/downloads/) ![MCP](https://modelcontextprotocol.io/)

🎯 它的作用

PriceScout通过让你问自然语言问题来消除手动竞争对手研究,例如:

  • “DeepInfra对Deepseek v3收取多少费用?”
  • “比较CloudRift AI和Groq对《Llama 3》的定价”
  • “所有供应商的最新价格是多少?”

该系统自动抓取竞争对手的网站,提取定价数据,将其存储在SQLite数据库中,并通过聊天机器人界面提供智能答案。

🏗️ 建筑

使用具有三个协调代理的模型上下文协议(MCP)构建:

  1. 法学硕士客户(克劳德) -编排工作流程并解释自然语言查询
  2. 自定义刮刀服务器 -使用带有元数据跟踪的Firecrawl API进行Web抓取
  3. SQLite数据库服务器 -定价数据的持久存储和检索
  4. 文件系统服务器 -通过MCP进行文件操作

✨ 特性

  • 🤖 自然语言查询界面
  • 🌐 使用Firecrawl自动抓取网页
  • 💾 用于历史跟踪的SQLite数据库
  • 📊 跨提供商的结构化定价比较
  • 🔄 元数据跟踪(抓取时间、URL、域、内容格式)
  • 🛠️ 可扩展的MCP服务器架构
  • 📁 具有组织结构的基于文件的内容存储

🚀 快速开始

先决条件

安装

  1. 克隆存储库
git clone https://github.com/yourusername/pricescout-mcp.git
cd pricescout-mcp
  1. 安装uv(如果尚未安装)
# macOS, Linux, WSL
curl -LsSf https://astral.sh/uv/install.sh | sh
source $HOME/.local/bin/env

# Verify installation
uv --version
  1. 同步依赖关系
# This will create a virtual environment and install all dependencies
uv sync
  1. 设置API密钥

获取API密钥:

创建一个 .env 项目根目录中的文件:

cp .env.example .env

编辑 .env 并添加您的密钥:

ANTHROPIC_API_KEY=your_anthropic_api_key_here
FIRECRAWL_API_KEY=your_firecrawl_api_key_here

运行项目

# Activate the virtual environment
source .venv/bin/activate

# Run the client
python src/starter_client.py

您应该看到:

Connected to 3 server(s)
Available tools: [list of tools from MCP servers]
Data extraction enabled

MCP Chatbot with Data Extraction Started!
Type your queries, 'show data' to view stored data, or 'quit' to exit.

Query:

示例用法

运行后,尝试以下查询:

  1. 淘汰竞争对手网站:
scrape these sites: {'cloudrift': 'https://www.cloudrift.ai/inference', 'deepinfra': 'https://deepinfra.com/pricing', 'groq': 'https://groq.com/pricing'}
  1. 查询定价信息:
How much does deepinfra charge for deepseek v3?
  1. 比较定价:
Compare cloudrift ai and deepinfra's costs for deepseek v3
  1. 查看存储的数据:
show data
  1. 退出:
quit

📁 项目结构

pricescout-mcp/
├── conf/
│   └── server_config.json      # MCP server configuration
├── src/
│   ├── starter_server.py       # Custom MCP scraper server
│   └── starter_client.py       # MCP client orchestrator
├── scraped_content/            # Auto-generated: scraped content
├── scraped_metadata.json       # Auto-generated: scraping metadata
├── test.db                     # Auto-generated: SQLite database
├── pyproject.toml             # Project dependencies
├── .env                       # Your API keys (create from .env.example)
├── .env.example               # Template for environment variables
├── .gitignore                 # Git ignore rules
└── README.md                  # This file

🎓 实施状态

✅ 完成

  • \[x\] 项目结构 conf/src/ 文件夹
  • \[x\] 环境设置 .env 文件
  • \[x\] 通过管理依赖关系 uv
  • \[x\] 配置加载来自 conf/server_config.json
  • \[x\] 使用MCP初始化服务器
  • \[x\] MCP服务器上的工具列表
  • \[x\] 使用重试机制执行工具
  • \[x\] 定价数据的数据库表设置

🚧 进行中

  • \[\]完成 scrape_websites 工具实施
  • \[\]完成 extract_scraped_info 工具实施
  • \[\]完成 ChatSession.process_query (工具使用循环)
  • \[\]完成 ChatSession.show_stored_data
  • \[\]完成 DataExtractor.extract_and_store_data

🔧 技术栈

  • 语言:Python 3.10+
  • LLM:人类克劳德(通过API)
  • Web剪贴:Firecrawl API
  • 数据库:SQLite(通过MCP)
  • 协议:模型上下文协议(MCP)
  • 程序包管理器:紫外线(星光)

🎯 支持的LLM提供商

  • Cloudrift AI: https://www.cloudrift.ai/inference
  • DeepInfra: https://deepinfra.com/pricing
  • 烟花: https://fireworks.ai/pricing#serverless-定价
  • Groq: https://groq.com/pricing

📝 开发说明

添加新提供商

要抓取新的提供者,只需将它们添加到您的查询中:

scrape these sites: {'provider_name': 'https://provider-url.com/pricing'}

故障排除

问题: command not found: uv

# Solution: Source the uv environment
source $HOME/.local/bin/env

问题: ANTHROPIC_API_KEY not found

# Solution: Ensure .env file exists and has your API key
cat .env  # Should show your keys

问题:MCP服务器无法启动

# Solution: Ensure Node.js is installed for filesystem server
node --version
npx --version

🤝 贡献

这是一个展示MCP架构和人工智能数据提取的投资组合项目。请随意分叉并在此基础上进行构建!

📄 许可证

此项目根据MIT许可证获得许可-请参阅 许可证 文件以获取详细信息。

MIT License
Copyright (c) 2025 Kinshuk

🙏 致谢

🎓 学习成果

该项目展示了:

  • 用Python构建自定义MCP服务器
  • 编排多代理AI工作流程
  • 使用API服务进行Web抓取(Firecrawl)
  • 通过MCP与SQLite进行数据库集成
  • LLM工具的使用和函数调用
  • 错误处理和重试逻辑
  • 结构化数据提取和存储

______________________________________________________________________

建于❤️ 使用模型上下文协议

目录标签

目录标签

浏览器自动化Python网页抓取价格分析本地部署自然语言处理数据存储市场研究

接入字段

传输方式(transport,传输协议)

stdio

鉴权方式(authType,认证方式)

api-key

运行时(runtime,运行环境)

Python

工具数量(toolCount,工具数)

0

资源数量(resourceCount,资源数)

0

提示词数量(promptCount,提示词数)

0

权限和风险

stdioapi-key部署方式未说明

接入前请确认传输方式、认证方式和部署位置,并根据实际工具能力限制访问范围。

安装前确认

不要直接授予不必要的文件、网络或账号权限;先核对安装命令和配置内容。

来源信息

继续浏览同类 MCP