Token导航 LogoToken导航TokenDH.com
Micro Casting Prototype logo
开发工具stdio官方级别未说明来源级核验

Micro Casting Prototype

MCP Server

一个基于Python的Monorepo项目,探索模型上下文协议(MCP)并集成Crawl4AI的网页爬取功能,适用于内容抓取和数据处理。

工具数

0

提示词数

0

GitHub Stars

0

资源数

0
网页爬取Python自动化测试

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

作者 / 组织

cprima

提供方

cprima

最后核验

2026/5/17 20:21

运行时

Python

快速接入

先看主来源和安装命令,再打开仓库或文档;下面只保留这个条目的关键接入事实。

命令预览

uv run python -c "from crawling.client import fetch_markdown_sync; print(fetch_markdown_sync('https://example.com'))"

详细介绍

微型铸造原型

一个Python单仓库项目,探索模型上下文协议(MCP),并具备由Crawl4AI驱动的网页抓取功能。

概述

这个仓库的组织结构为 UV工作区 带有共享库和应用程序:

  • libs/跨应用程序共享的可重用库

- crawling基于Crawl4AI的网页抓取客户端

  • apps/应用项目

- uipac/ingestor内容摄入服务

特点/功能

  • 🚀 表情符号“🚀”通常表示火箭、太空旅行或快速前进等概念,但直接翻译时,由于其本身是一种图形符号,没有直接的中文文字对应,所以可以意译为“火箭”或“飞速前进”等,具体根据上下文来确定。在没有具体上下文的情况下,一个通用的翻译是“火箭”。 快速依赖管理 (介词)和……一起;带着;具有 紫外线
  • 🕷️(蜘蛛) 高级网页抓取 通过 Crawl4AI 可以翻译为“用于AI的爬虫”或“AI爬虫工具” 0.7.6
  • 📦 表示“箱子”或“包裹”。 单仓库工作区 为了代码共享和一致性
  • 🔧 修理工具/螺丝刀(或类似的修理相关图标含义) Makefile 对于可重复的开发工作流程
  • 🎭 表情符号:小丑脸 剧作家集成 用于无头浏览器自动化

仓库结构

micro-casting-prototype/
├── pyproject.toml              # Root workspace configuration
├── Makefile                    # Development automation
├── README.md                   # This file
├── .venv/                      # Virtual environment (created on setup)
├── libs/                       # Shared libraries
│   └── crawling/               # Web scraping library
│       ├── pyproject.toml      # Crawl4AI dependency (0.7.6)
│       ├── README.md           # Library documentation
│       └── src/
│           └── crawling/
│               ├── __init__.py
│               └── client.py   # Main crawling implementation
└── apps/                       # Application projects
    └── uipac/
        └── ingestor/           # Content ingestion app
            └── pyproject.toml  # Depends on "crawling"

快速入门

先决条件

  • Python 3.10及以上版本
  • 紫外线 包管理器 (安装指南)
# Install uv (if not already installed)
curl -LsSf https://astral.sh/uv/install.sh | sh
# or on Windows:
powershell -c "irm https://astral.sh/uv/install.ps1 | iex"

设置

# Clone the repository
git clone 
cd micro-casting-prototype

# Complete setup: sync dependencies, install packages, setup playwright
make setup

# Verify installation
make verify

测试爬取库

# Test web scraping with example.com
make test-crawling

# Or run manually
uv run python -c "from crawling.client import fetch_markdown_sync; print(fetch_markdown_sync('https://example.com'))"

可用命令

make help 查看所有可用命令:

命令描述
make setup完整设置:同步依赖项,安装包,配置 Playwright
make sync 同步并解决工作区依赖项
make install以可编辑模式安装工作区包
make playwright安装 Playwright 的 Chromium 浏览器
make test-crawling使用 example.com 测试爬虫库
make verify验证安装
make clean删除虚拟环境和缓存
make reinstall清理并重新安装所有内容

图书馆

爬行图书馆

位于 libs/crawling/这个库为网页抓取提供了一个简单的接口。

特点:

  • 异步和同步API
  • 内置缓存
  • 无头浏览器自动化
  • Markdown 输出

用法:

from crawling.client import fetch_markdown_sync

# Scrape a web page and get markdown
content = fetch_markdown_sync('https://example.com')
print(content)

📖 书籍 完整文档

应用程序

UIPAC Ingestor(注:UIPAC可能是一个特定上下文或领域的缩写,这里直接保留原样,若UIPAC有特定含义,需根据上下文替换)翻译为中文可以是“UIPAC数据摄入器”或“UIPAC信息摄取器”,具体取决于“UIPAC”所代表的具体含义以及“Ingestor”在该上下文中的准确功能描述。如果“UIPAC”是一个已知的、有特定含义的术语,那么翻译时应替换为相应的中文表述。在缺乏具体上下文的情况下,“数据摄入器”或“信息摄取器”是一个较为通用的翻译

位于 apps/uipac/ingestor/这个应用程序负责内容摄入处理。

依赖项:

  • crawling 库(用于网页抓取)

发展

添加新库

  1. 在(某个位置)创建一个新目录 libs/
   mkdir -p libs/mylib/src/mylib
  1. 创建 libs/mylib/pyproject.toml
   [project]
   name = "mylib"
   version = "0.0.1"
   requires-python = ">=3.10"
   dependencies = []

   [build-system]
   requires = ["hatchling"]
   build-backend = "hatchling.build"
  1. 以可编辑模式安装:
   uv pip install -e libs/mylib

添加新应用程序

  1. 在(某个位置)创建一个新目录 apps/
   mkdir -p apps/myapp
  1. 创建 apps/myapp/pyproject.toml
   [project]
   name = "myapp"
   version = "0.0.1"
   requires-python = ">=3.10"
   dependencies = ["crawling"]  # Add dependencies
  1. 以可编辑模式安装:
   uv pip install -e apps/myapp

工作区配置

根源 pyproject.toml 定义工作区成员:

[tool.uv.workspace]
members = ["libs/*", "apps/*", "apps/*/*"]

这允许:

  • 共享依赖项一次钉定版本,随处可用
  • 可编辑安装更改立即生效
  • 跨项目导入从……导入 crawlinguipac等。

依赖管理

# Add a dependency to a specific package
cd libs/crawling
uv add requests

# Update all dependencies
uv sync --upgrade

# Lock dependencies without installing
uv lock

关键技术

工作空间优势

✅(对号,表示正确、确认或完成) 统一依赖管理一个锁定文件,版本一致 ✅ 代码重用跨应用共享库 ✅ 快速安装UV的并行下载和缓存 ✅ 可编辑模式变化瞬间传播 ✅ 简化的持续集成/持续部署(CI/CD)单身 make setup 命令

故障排除

未找到包

# Reinstall in editable mode
uv pip install -e libs/crawling

Playwright 浏览器缺失

make playwright
# or
uv run playwright install chromium

导入错误

# Verify workspace members
uv sync --verbose

# Check installed packages
uv pip list

全新安装

make reinstall

注释

  • uv sync 读取工作区,并以可编辑模式安装库和应用程序
  • crawl4ai 被钉住一次后 libs/crawling/pyproject.toml其他应用只是依赖于 crawling
  • 保持每个子项目的 pyproject.toml 最小的;最低限度的; uv 自动处理链接

资源

许可证

\[您的许可证在此\]

做出贡献

\[如适用,请参阅贡献指南\]

目录标签

目录标签

网页爬取Python自动化测试本地部署MonorepoPython工具内容抓取

接入字段

传输方式(transport,传输协议)

stdio

鉴权方式(authType,认证方式)

none

运行时(runtime,运行环境)

Python

工具数量(toolCount,工具数)

0

资源数量(resourceCount,资源数)

0

提示词数量(promptCount,提示词数)

0

权限和风险

stdionone部署方式未说明

接入前请确认传输方式、认证方式和部署位置,并根据实际工具能力限制访问范围。

安装前确认

不要直接授予不必要的文件、网络或账号权限;先核对安装命令和配置内容。

来源信息

继续浏览同类 MCP