DevStudio MCP:生产级屏幕录制服务器
       
用于屏幕录制和演示自动化的生产级MCP服务器 -第一阶段发布 6个专业录音工具 支持多显示器、音频/视频多路复用和无缝集成,用于AI驱动的演示工作流程。
mcp名称:devstudio
🚀 快速开始
安装
方法1:uvx(推荐-零安装)
# Run directly without installation
uvx devstudio-mcp非常适合AI代理和快速测试-无需设置!
方法2:PyPI安装
# Install from PyPI
pip install devstudio-mcp
# Run the server
devstudio-mcp
# Or as module: python -m devstudio_mcp.server方法3:开发安装
# Clone the repository
git clone https://github.com/nihitgupta2/devstudio.git
cd devstudio
# Install with uv (recommended)
uv sync
# Or with pip
pip install -e .
# Run the server
devstudio-mcp🎯 Claude代码插件安装
一个命令安装 (推荐给Claude Code用户):
/plugin marketplace add nihitgupta2/devstudio这会自动:
- ✅ 用Claude代码配置DevStudio MCP
- ✅ 通过uvx安装(零安装方法)
- ✅ 立即启用所有6个录制工具
手动配置 (备选方案):
添加到您的Claude Code MCP设置中:
{
"mcpServers": {
"devstudio": {
"command": "uvx",
"args": ["devstudio-mcp"]
}
}
}注: FFmpeg与PyAV捆绑在一起-不需要单独安装!该软件包包括专业视频编码所需的一切。
🎯 第一阶段特征
📹 专业录音工具(6个活动工具)
- 多监视器录制:在多显示器设置中捕获任何屏幕
- 音频捕获:具有实时处理功能的专业录音
- 音频/视频混音:将单独的流自动组合成单个MP4文件
- 屏幕截图工具:带元数据的单镜头屏幕截图
- 会话管理:跟踪和管理多个录制会话
- 终端监控:命令历史记录和输出捕获
📊 工具概述
| 工具 | 描述 | 状态 |
|---|---|---|
start_recording | 开始屏幕/音频/终端录制会话 | ✅ 活动 |
stop_recording | 停止录制并获取输出文件 | ✅ 活动 |
capture_screen | 拍摄单张截图 | ✅ 活动 |
list_active_sessions | 列出所有活动录制会话 | ✅ 活动 |
mux_audio_video | 合并单独的音频和视频文件 | ✅ 活动 |
get_available_screens | 获取所有监视器的信息 | ✅ 活动 |
🛠️ MCP工具参考
📹 录音工具
start_recording
开始新的录制会话 具有屏幕、音频和/或终端捕获功能。
{
"include_screen": true,
"include_audio": true,
"include_terminal": false,
"output_format": "mp4",
"screen_id": 1,
"auto_mux": true,
"cleanup_source_files": false
}- 退货:会话ID、状态、输出目录、录制类型
- 用例:开始捕获屏幕演示、教程或演示文稿
- 特性:
- 多显示器支持(选择特定屏幕 screen_id) - 自动多路复用:自动将音频+视频组合成单个MP4(默认值:true) - 清理:多路复用后删除源文件(默认值:false) - 仅音频:设置 include_screen=false, include_audio=true
stop_recording
停止活动录制会话 并检索输出文件路径。
{
"session_id": "uuid-of-session"
}- 退货:屏幕/音频/终端/组合的文件路径,会话持续时间
- 用例:结束录制并获取文件位置
- 备注:何时
auto_mux=true同时录制屏幕和音频,返回combined.mp4文件
capture_screen
截取一个屏幕截图 任何监视器。
{
"screen_id": 1
}- 退货:屏幕截图文件路径、尺寸、格式、大小
- 用例:快速捕获文档或错误报告
- 特性:通过以下方式支持多显示器
screen_id参数
list_active_sessions
列出所有活动录制会话 以及他们的地位。
- 退货:具有ID、开始时间和类型的活动会话列表
- 用例:监控正在进行的录制或管理多个会话
mux_audio_video
合并单独的音频和视频文件 变成一个MP4。
{
"video_path": "/path/to/video.mp4",
"audio_path": "/path/to/audio.wav",
"output_path": "/path/to/output.mp4"
}- 退货:混合文件路径、输入文件、大小
- 用例:合并单独录制的流或修复同步问题
- 备注:使用PyAV进行专业H.264/AAC编码
get_available_screens
获取所有可用监视器的信息 以及它们的性质。
- 退货:带有ID、分辨率、位置和比例的屏幕列表
- 用例:在多屏幕设置中选择特定的监视器进行录制
🗺️ 路线图-发展阶段
✅ 第1阶段:记录基础设施(当前版本-1.0.0)
状态:生产就绪 发布2024年第四季度
- ✅ 6个生产就绪记录工具
- ✅ 多显示器支持屏幕选择
- ✅ 音频/视频复用(H.264+AAC)
- ✅ 专业屏幕截图
- ✅ 会话管理
- ✅ PyAV集成(捆绑FFmpeg)
______________________________________________________________________
🚧 第二阶段:人工智能驱动的处理(开发中)
目标2025年第一季度 分支: archive/phase-2-3-ai-features
特征:
- 🔜 音频转录 使用OpenAI Whisper
- 🔜 多提供商AI (OpenAI、Anthropic、谷歌)
- 🔜 内容分析 具有主题检测功能
- 🔜 代码提取 来自录音
- 🔜 自动章节检测 带有时间戳
工具 (3):
transcribe_audio-将音频转换为带有时间戳的文本analyze_content-提取主题、术语和结构extract_code-识别和分类代码片段
______________________________________________________________________
📋 第3阶段:内容生成(计划中)
目标:2025年第二季度
特征:
- 📋 AI生成 博客文章 来自录音
- 📋 自动 文档创建
- 📋 课程大纲生成
- 📋 多格式内容导出(Markdown、HTML、PDF)
- 📋 带有时间戳的YouTube描述
工具 (4):
generate_blog_post-创建技术博客文章create_documentation-生成API/功能文档generate_summary-可配置的内容摘要create_course_outline-教育内容结构
______________________________________________________________________
💎 第四阶段:货币化和团队(未来)
目标:2025年第3季度
特征:
- 💎 基于层的功能访问 (免费、专业、团队、企业)
- 💎 使用情况跟踪和分析
- 💎 许可证管理系统
- 💎 团队协作功能
- 💎 自定义品牌选项
工具 (3):
get_license_info-检查订阅状态check_feature_access-验证功能可用性get_usage_stats-监控使用情况和配额
______________________________________________________________________
🔮 愿景:自主演示录制平台
DevStudio MCP正在发展成为 综合自主演示录音平台 它将专业的录音基础设施与人工智能驱动的浏览器自动化相结合。
🌐 未来:人工智能驱动的演示创建
想象: 一个人工智能代理,可以通过控制浏览器、记录每次交互和生成文档来自主创建完整的产品演示,所有这些都是通过MCP编排的。
🤖 AWS Nova法案集成
用于端到端演示创建的自主浏览器控制
DevStudio MCP将与AWS Nova Act代理集成,以实现完全自动化的演示工作流程:
graph LR
A[MCP: Start Recording] --> B[Nova Act: Browser Automation]
B --> C[Autonomous Actions]
C --> D[MCP: Stop Recording]
D --> E[Complete Demo Video]示例工作流程:电子商务演示
# Start recording via MCP
mcp_client.call_tool("start_recording", {
"include_screen": true,
"include_audio": true,
"auto_mux": true
})
# Launch Nova Act for browser automation
from nova_act import NovaAct
nova = NovaAct(api_key="key")
# Agent performs complete workflow autonomously
nova.act("Visit amazon.com, search for wireless headphones, \
filter by price under $100, add top rated to cart, \
proceed to checkout page")
# Stop recording
result = mcp_client.call_tool("stop_recording", {
"session_id": session_id
})
# Result: Professionally recorded e-commerce demo
print(f"Demo recorded: {result['files']['combined']}")🎯 用例
1. SaaS产品演示
自动记录多步用户旅程:
- 帐户创建和入职
- 特征探索工作流程
- 集成设置过程
- 管理面板操作
2. 教程创建
捕捉复杂的技术工作流程:
- 开发环境设置
- API集成示例
- 调试会话
- 代码重构演示
3. 质量保证和测试
使用浏览器交互记录测试场景:
- 自动测试执行捕获
- Bug再现记录
- 回归测试文档
- 用户验收测试(UAT)视频
4. 客户入职培训
创建个性化演示内容:
- 产品演练
- 功能教程
- 最佳实践指南
- 故障排除演示
🔗 MCP编排架构
┌─────────────────────────────────────────────┐
│ MCP DevStudio Recording Server (Phase 1) │
│ • start_recording │
│ • capture_screen │
│ • stop_recording │
│ • multi-monitor support │
└──────────────┬──────────────────────────────┘
│ Orchestrates
↓
┌─────────────────────────────────────────────┐
│ AWS Nova Act Browser Automation │
│ • Navigate websites autonomously │
│ • Fill forms with natural language │
│ • Click & interact intelligently │
│ • Multi-step workflow execution │
└──────────────┬──────────────────────────────┘
│
↓
┌─────────────────────────────────────────────┐
│ AI Processing Pipeline (Phase 2-3) │
│ • Transcribe narration │
│ • Generate documentation │
│ • Create blog posts │
│ • Extract code snippets │
└─────────────────────────────────────────────┘
│
↓ Complete Demo Package🚀 用户定义环境集成
超越浏览器 -在任何环境中录制演示:
- 本地应用:桌面软件演示
- 云平台:AWS控制台、Azure门户、GCP
- 开发工具:VS代码、IDE、终端
- 定制系统:内部工具、专有软件
Nova Act代理可以配置为与几乎任何基于web的界面进行交互,使DevStudio MCP成为 通用记录基础设施 用于AI驱动的演示创建。
🌟 为什么这很重要
传统演示创建:
- ⏰ 手动录制和编辑的小时数
- 🎬 多次尝试以获得正确结果
- 📝 手动文档编写
- 🔄 需要不断更新
由DevStudio MCP+Nova Act驱动的人工智能:
- ⚡ 端到端自动化 -从浏览器到视频
- 🎯 始终如一的质量 -每次都完美执行
- 📚 自动文档 -人工智能生成的内容
- 🔁 一键更新 -立即重新录制整个演示
______________________________________________________________________
📖 使用示例
完成录制工作流程
# 1. Check available monitors
screens = await get_available_screens()
# Returns: [{"id": 0, "width": 1920, "height": 1080, ...}, ...]
# 2. Start recording a tutorial on second monitor
session = await start_recording({
"include_screen": true,
"include_audio": true,
"screen_id": 1, # Second monitor
"output_format": "mp4",
"auto_mux": true
})
# Returns: {"session_id": "...", "status": "recording"}
# 3. Record your demo...
# 4. Take a quick screenshot during recording
screenshot = await capture_screen({"screen_id": 1})
# Returns: {"file_path": "/path/to/screenshot.png", ...}
# 5. Stop recording and get files
result = await stop_recording({
"session_id": session["session_id"]
})
# Returns: {"files": {"combined": "/path/to/combined.mp4"}, "duration": 120.5}多监视器录制
# Get all available screens
screens = await get_available_screens()
print(f"Found {len(screens)} monitors")
# Record specific monitor
session = await start_recording({
"include_screen": true,
"screen_id": 2, # Third monitor
"include_audio": true
})音频/视频混音
# Record audio and video separately
session = await start_recording({
"include_screen": true,
"include_audio": true,
"auto_mux": false # Don't auto-combine
})
result = await stop_recording({"session_id": session["session_id"]})
# Manually mux later with custom settings
muxed = await mux_audio_video({
"video_path": result["files"]["screen"],
"audio_path": result["files"]["audio"],
"output_path": "/custom/path/final_demo.mp4"
})🔧 配置
环境变量
| 变量 | 描述 | 必填 | 默认 |
|---|---|---|---|
RECORDING_OUTPUT_DIR | 录音输出目录 | 否 | ~/devstudio/recordings |
MAX_RECORDING_DURATION | 最大录制时长(秒) | 否 | 3600(1小时) |
RECORDING_QUALITY | 质量设置(低、中、高) | 否 | 中等 |
RECORDING_FPS | 每秒帧数 | 否 | 30 |
LOG_LEVEL | 日志记录级别(调试、信息、警告、错误) | 否 | 信息 |
默认录制设置
# Default configuration
recording:
output_dir: ~/devstudio/recordings
max_duration: 3600 # 1 hour
quality: medium
fps: 30
audio_enabled: true
auto_mux: true🧪 测试
# Run all tests
uv run pytest
# Run with coverage
uv run pytest --cov=devstudio_mcp
# Test recording tools specifically
uv run pytest tests/test_recording.py -v🏗️ 建筑
devstudio_mcp/
├── server.py # Main MCP server (Phase 1)
├── registry.py # Tool registration (6 tools active)
├── config.py # Configuration management
├── tools/
│ └── recording.py # 6 recording tools (ACTIVE)
├── resources/
│ └── media_manager.py # Media file management
└── utils/
├── exceptions.py # Error handling
└── logger.py # Structured logging第2/3阶段存档 (保存在git分支中) archive/phase-2-3-ai-features):
tools/processing.py-人工智能转录和分析(3个工具)tools/generation.py-内容生成(4个工具)monetization.py-许可证管理(3个工具)prompts/-AI提示模板resources/session_data.py-会话资源
🤝 贡献
- 分叉存储库
- 创建要素分支(
git checkout -b feature/amazing-feature) - 提交您的更改(
git commit -m 'Add amazing feature') - 推到分支(
git push origin feature/amazing feature) - 打开拉取请求
📄 许可证
DevStudio MCP具有双重许可 AGPL v3 (开源)和 商业许可证 (专有使用)。
开源许可证(AGPL v3)
免费:
- ✅ 个人项目和教育
- ✅ 开源项目
- ✅ 公司内部工具
- ✅ 研究和非商业用途
要求:
- ⚠️ 如果修改此软件,则必须将修改作为AGPL v3发布
- ⚠️ 如果你在网络服务(SaaS)中使用它,你必须将整个应用程序开源
完整的AGPL v3许可证: 许可证 | https://www.gnu.org/licenses/agpl-3.0.html
商业许可证
需要:
- 💼 商业SaaS产品(专有)
- 💼 销售包含DevStudio MCP的软件
- 💼 保持您的修改专有
- 💼 没有开源的企业部署
优点:
- ✅ 无AGPL copyleft要求
- ✅ 保持代码的专有性
- ✅ 优先支持和更新
- ✅ 商业用途赔偿
- ✅ 提供自定义许可条款
定价:
- 初创公司:收入\1000万美元收入-自定义条款
📧 商业许可联系人: nihitgupta.ng@outlook.com
详细信息: 许可证-商业.txt
______________________________________________________________________
为什么是双重许可?
我们相信开源,同时建立可持续的业务。AGPL v3确保社区从改进中受益,而商业许可允许企业在专有应用程序中使用DevStudio MCP。
🙏 致谢
- 模型上下文协议 -基础协议
- FastMCP -Python MCP框架
- PyAV -带有捆绑二进制文件的FFmpeg绑定
- AWS Nova法案 -浏览器自动化SDK
- mcpcat.io -MCP最佳实践和指南
📞 支持
- 📧 电子邮件:nihitgupta.ng@outlook.com
- 🐛 问题:
- 💼 商业许可:nihitgupta.ng@outlook.com
______________________________________________________________________
内置❤️ 为开发人员创建令人惊叹的演示和教程
*第2/3阶段的功能(人工智能处理、内容生成、货币化)正在积极开发中,并保存在git branch中: archive/phase-2-3-ai-features*
