Token导航 LogoToken导航TokenDH.com
Dev Studio logo
音视频stdio官方级别未说明来源级核验

Dev Studio

MCP Server

生产级屏幕录制服务器,支持多显示器录制、音频/视频混合及AI驱动的工作流集成,适用于产品演示、教程录制等场景。

工具数

0

提示词数

0

GitHub Stars

4

资源数

0
PythonClaude语音音频Claude

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

作者 / 组织

nihitgupta2

提供方

nihitgupta2

最后核验

2026/5/17 20:23

运行时

Python

快速接入

先看主来源和安装命令,再打开仓库或文档;下面只保留这个条目的关键接入事实。

命令预览

uvx devstudio-mcp

详细介绍

DevStudio MCP:生产级屏幕录制服务器

![MCP Compatible](https://modelcontextprotocol.io/) ![Python 3.11+](https://www.python.org/downloads/) ![PyPI](https://pypi.org/project/devstudio-mcp/) ![Claude Code Plugin](https://github.com/nihitgupta2/devstudio) ![Production Ready](https://github.com/nihitgupta2/devstudio) ![6 Tools Active](https://github.com/nihitgupta2/devstudio) ![10 Tools in Roadmap](https://github.com/nihitgupta2/devstudio) ![AGPL License](LICENSE)

用于屏幕录制和演示自动化的生产级MCP服务器 -第一阶段发布 6个专业录音工具 支持多显示器、音频/视频多路复用和无缝集成,用于AI驱动的演示工作流程。

mcp名称:devstudio

🚀 快速开始

安装

方法1:uvx(推荐-零安装)

# Run directly without installation
uvx devstudio-mcp

非常适合AI代理和快速测试-无需设置!

方法2:PyPI安装

# Install from PyPI
pip install devstudio-mcp

# Run the server
devstudio-mcp
# Or as module: python -m devstudio_mcp.server

方法3:开发安装

# Clone the repository
git clone https://github.com/nihitgupta2/devstudio.git
cd devstudio

# Install with uv (recommended)
uv sync

# Or with pip
pip install -e .

# Run the server
devstudio-mcp

🎯 Claude代码插件安装

一个命令安装 (推荐给Claude Code用户):

/plugin marketplace add nihitgupta2/devstudio

这会自动:

  • ✅ 用Claude代码配置DevStudio MCP
  • ✅ 通过uvx安装(零安装方法)
  • ✅ 立即启用所有6个录制工具

手动配置 (备选方案):

添加到您的Claude Code MCP设置中:

{
  "mcpServers": {
    "devstudio": {
      "command": "uvx",
      "args": ["devstudio-mcp"]
    }
  }
}

注: FFmpeg与PyAV捆绑在一起-不需要单独安装!该软件包包括专业视频编码所需的一切。

🎯 第一阶段特征

📹 专业录音工具(6个活动工具)

  • 多监视器录制:在多显示器设置中捕获任何屏幕
  • 音频捕获:具有实时处理功能的专业录音
  • 音频/视频混音:将单独的流自动组合成单个MP4文件
  • 屏幕截图工具:带元数据的单镜头屏幕截图
  • 会话管理:跟踪和管理多个录制会话
  • 终端监控:命令历史记录和输出捕获

📊 工具概述

工具描述状态
start_recording开始屏幕/音频/终端录制会话✅ 活动
stop_recording停止录制并获取输出文件✅ 活动
capture_screen拍摄单张截图✅ 活动
list_active_sessions列出所有活动录制会话✅ 活动
mux_audio_video合并单独的音频和视频文件✅ 活动
get_available_screens获取所有监视器的信息✅ 活动

🛠️ MCP工具参考

📹 录音工具

start_recording

开始新的录制会话 具有屏幕、音频和/或终端捕获功能。

{
    "include_screen": true,
    "include_audio": true,
    "include_terminal": false,
    "output_format": "mp4",
    "screen_id": 1,
    "auto_mux": true,
    "cleanup_source_files": false
}
  • 退货:会话ID、状态、输出目录、录制类型
  • 用例:开始捕获屏幕演示、教程或演示文稿
  • 特性:

- 多显示器支持(选择特定屏幕 screen_id) - 自动多路复用:自动将音频+视频组合成单个MP4(默认值:true) - 清理:多路复用后删除源文件(默认值:false) - 仅音频:设置 include_screen=false, include_audio=true

stop_recording

停止活动录制会话 并检索输出文件路径。

{
    "session_id": "uuid-of-session"
}
  • 退货:屏幕/音频/终端/组合的文件路径,会话持续时间
  • 用例:结束录制并获取文件位置
  • 备注:何时 auto_mux=true 同时录制屏幕和音频,返回 combined.mp4 文件

capture_screen

截取一个屏幕截图 任何监视器。

{
    "screen_id": 1
}
  • 退货:屏幕截图文件路径、尺寸、格式、大小
  • 用例:快速捕获文档或错误报告
  • 特性:通过以下方式支持多显示器 screen_id 参数

list_active_sessions

列出所有活动录制会话 以及他们的地位。

  • 退货:具有ID、开始时间和类型的活动会话列表
  • 用例:监控正在进行的录制或管理多个会话

mux_audio_video

合并单独的音频和视频文件 变成一个MP4。

{
    "video_path": "/path/to/video.mp4",
    "audio_path": "/path/to/audio.wav",
    "output_path": "/path/to/output.mp4"
}
  • 退货:混合文件路径、输入文件、大小
  • 用例:合并单独录制的流或修复同步问题
  • 备注:使用PyAV进行专业H.264/AAC编码

get_available_screens

获取所有可用监视器的信息 以及它们的性质。

  • 退货:带有ID、分辨率、位置和比例的屏幕列表
  • 用例:在多屏幕设置中选择特定的监视器进行录制

🗺️ 路线图-发展阶段

✅ 第1阶段:记录基础设施(当前版本-1.0.0)

状态:生产就绪 发布2024年第四季度

  • 6个生产就绪记录工具
  • ✅ 多显示器支持屏幕选择
  • ✅ 音频/视频复用(H.264+AAC)
  • ✅ 专业屏幕截图
  • ✅ 会话管理
  • ✅ PyAV集成(捆绑FFmpeg)

______________________________________________________________________

🚧 第二阶段:人工智能驱动的处理(开发中)

目标2025年第一季度 分支: archive/phase-2-3-ai-features

特征:

  • 🔜 音频转录 使用OpenAI Whisper
  • 🔜 多提供商AI (OpenAI、Anthropic、谷歌)
  • 🔜 内容分析 具有主题检测功能
  • 🔜 代码提取 来自录音
  • 🔜 自动章节检测 带有时间戳

工具 (3):

  • transcribe_audio -将音频转换为带有时间戳的文本
  • analyze_content -提取主题、术语和结构
  • extract_code -识别和分类代码片段

______________________________________________________________________

📋 第3阶段:内容生成(计划中)

目标:2025年第二季度

特征:

  • 📋 AI生成 博客文章 来自录音
  • 📋 自动 文档创建
  • 📋 课程大纲生成
  • 📋 多格式内容导出(Markdown、HTML、PDF)
  • 📋 带有时间戳的YouTube描述

工具 (4):

  • generate_blog_post -创建技术博客文章
  • create_documentation -生成API/功能文档
  • generate_summary -可配置的内容摘要
  • create_course_outline -教育内容结构

______________________________________________________________________

💎 第四阶段:货币化和团队(未来)

目标:2025年第3季度

特征:

  • 💎 基于层的功能访问 (免费、专业、团队、企业)
  • 💎 使用情况跟踪和分析
  • 💎 许可证管理系统
  • 💎 团队协作功能
  • 💎 自定义品牌选项

工具 (3):

  • get_license_info -检查订阅状态
  • check_feature_access -验证功能可用性
  • get_usage_stats -监控使用情况和配额

______________________________________________________________________

🔮 愿景:自主演示录制平台

DevStudio MCP正在发展成为 综合自主演示录音平台 它将专业的录音基础设施与人工智能驱动的浏览器自动化相结合。

🌐 未来:人工智能驱动的演示创建

想象: 一个人工智能代理,可以通过控制浏览器、记录每次交互和生成文档来自主创建完整的产品演示,所有这些都是通过MCP编排的。

🤖 AWS Nova法案集成

用于端到端演示创建的自主浏览器控制

DevStudio MCP将与AWS Nova Act代理集成,以实现完全自动化的演示工作流程:

graph LR
    A[MCP: Start Recording] --> B[Nova Act: Browser Automation]
    B --> C[Autonomous Actions]
    C --> D[MCP: Stop Recording]
    D --> E[Complete Demo Video]

示例工作流程:电子商务演示

# Start recording via MCP
mcp_client.call_tool("start_recording", {
    "include_screen": true,
    "include_audio": true,
    "auto_mux": true
})

# Launch Nova Act for browser automation
from nova_act import NovaAct
nova = NovaAct(api_key="key")

# Agent performs complete workflow autonomously
nova.act("Visit amazon.com, search for wireless headphones, \
          filter by price under $100, add top rated to cart, \
          proceed to checkout page")

# Stop recording
result = mcp_client.call_tool("stop_recording", {
    "session_id": session_id
})

# Result: Professionally recorded e-commerce demo
print(f"Demo recorded: {result['files']['combined']}")

🎯 用例

1. SaaS产品演示

自动记录多步用户旅程:

  • 帐户创建和入职
  • 特征探索工作流程
  • 集成设置过程
  • 管理面板操作

2. 教程创建

捕捉复杂的技术工作流程:

  • 开发环境设置
  • API集成示例
  • 调试会话
  • 代码重构演示

3. 质量保证和测试

使用浏览器交互记录测试场景:

  • 自动测试执行捕获
  • Bug再现记录
  • 回归测试文档
  • 用户验收测试(UAT)视频

4. 客户入职培训

创建个性化演示内容:

  • 产品演练
  • 功能教程
  • 最佳实践指南
  • 故障排除演示

🔗 MCP编排架构

┌─────────────────────────────────────────────┐
│  MCP DevStudio Recording Server (Phase 1)  │
│  • start_recording                          │
│  • capture_screen                           │
│  • stop_recording                           │
│  • multi-monitor support                    │
└──────────────┬──────────────────────────────┘
               │ Orchestrates
               ↓
┌─────────────────────────────────────────────┐
│  AWS Nova Act Browser Automation            │
│  • Navigate websites autonomously           │
│  • Fill forms with natural language         │
│  • Click & interact intelligently           │
│  • Multi-step workflow execution            │
└──────────────┬──────────────────────────────┘
               │
               ↓
┌─────────────────────────────────────────────┐
│  AI Processing Pipeline (Phase 2-3)         │
│  • Transcribe narration                     │
│  • Generate documentation                   │
│  • Create blog posts                        │
│  • Extract code snippets                    │
└─────────────────────────────────────────────┘
               │
               ↓ Complete Demo Package

🚀 用户定义环境集成

超越浏览器 -在任何环境中录制演示:

  • 本地应用:桌面软件演示
  • 云平台:AWS控制台、Azure门户、GCP
  • 开发工具:VS代码、IDE、终端
  • 定制系统:内部工具、专有软件

Nova Act代理可以配置为与几乎任何基于web的界面进行交互,使DevStudio MCP成为 通用记录基础设施 用于AI驱动的演示创建。

🌟 为什么这很重要

传统演示创建:

  • ⏰ 手动录制和编辑的小时数
  • 🎬 多次尝试以获得正确结果
  • 📝 手动文档编写
  • 🔄 需要不断更新

由DevStudio MCP+Nova Act驱动的人工智能:

  • 端到端自动化 -从浏览器到视频
  • 🎯 始终如一的质量 -每次都完美执行
  • 📚 自动文档 -人工智能生成的内容
  • 🔁 一键更新 -立即重新录制整个演示

______________________________________________________________________

📖 使用示例

完成录制工作流程

# 1. Check available monitors
screens = await get_available_screens()
# Returns: [{"id": 0, "width": 1920, "height": 1080, ...}, ...]

# 2. Start recording a tutorial on second monitor
session = await start_recording({
    "include_screen": true,
    "include_audio": true,
    "screen_id": 1,  # Second monitor
    "output_format": "mp4",
    "auto_mux": true
})
# Returns: {"session_id": "...", "status": "recording"}

# 3. Record your demo...

# 4. Take a quick screenshot during recording
screenshot = await capture_screen({"screen_id": 1})
# Returns: {"file_path": "/path/to/screenshot.png", ...}

# 5. Stop recording and get files
result = await stop_recording({
    "session_id": session["session_id"]
})
# Returns: {"files": {"combined": "/path/to/combined.mp4"}, "duration": 120.5}

多监视器录制

# Get all available screens
screens = await get_available_screens()
print(f"Found {len(screens)} monitors")

# Record specific monitor
session = await start_recording({
    "include_screen": true,
    "screen_id": 2,  # Third monitor
    "include_audio": true
})

音频/视频混音

# Record audio and video separately
session = await start_recording({
    "include_screen": true,
    "include_audio": true,
    "auto_mux": false  # Don't auto-combine
})

result = await stop_recording({"session_id": session["session_id"]})

# Manually mux later with custom settings
muxed = await mux_audio_video({
    "video_path": result["files"]["screen"],
    "audio_path": result["files"]["audio"],
    "output_path": "/custom/path/final_demo.mp4"
})

🔧 配置

环境变量

变量描述必填默认
RECORDING_OUTPUT_DIR录音输出目录~/devstudio/recordings
MAX_RECORDING_DURATION最大录制时长(秒)3600(1小时)
RECORDING_QUALITY质量设置(低、中、高)中等
RECORDING_FPS每秒帧数30
LOG_LEVEL日志记录级别(调试、信息、警告、错误)信息

默认录制设置

# Default configuration
recording:
  output_dir: ~/devstudio/recordings
  max_duration: 3600  # 1 hour
  quality: medium
  fps: 30
  audio_enabled: true
  auto_mux: true

🧪 测试

# Run all tests
uv run pytest

# Run with coverage
uv run pytest --cov=devstudio_mcp

# Test recording tools specifically
uv run pytest tests/test_recording.py -v

🏗️ 建筑

devstudio_mcp/
├── server.py              # Main MCP server (Phase 1)
├── registry.py            # Tool registration (6 tools active)
├── config.py              # Configuration management
├── tools/
│   └── recording.py       # 6 recording tools (ACTIVE)
├── resources/
│   └── media_manager.py   # Media file management
└── utils/
    ├── exceptions.py      # Error handling
    └── logger.py         # Structured logging

第2/3阶段存档 (保存在git分支中) archive/phase-2-3-ai-features):

  • tools/processing.py -人工智能转录和分析(3个工具)
  • tools/generation.py -内容生成(4个工具)
  • monetization.py -许可证管理(3个工具)
  • prompts/ -AI提示模板
  • resources/session_data.py -会话资源

🤝 贡献

  1. 分叉存储库
  2. 创建要素分支(git checkout -b feature/amazing-feature)
  3. 提交您的更改(git commit -m 'Add amazing feature')
  4. 推到分支(git push origin feature/amazing feature)
  5. 打开拉取请求

📄 许可证

DevStudio MCP具有双重许可 AGPL v3 (开源)和 商业许可证 (专有使用)。

开源许可证(AGPL v3)

免费:

  • ✅ 个人项目和教育
  • ✅ 开源项目
  • ✅ 公司内部工具
  • ✅ 研究和非商业用途

要求:

  • ⚠️ 如果修改此软件,则必须将修改作为AGPL v3发布
  • ⚠️ 如果你在网络服务(SaaS)中使用它,你必须将整个应用程序开源

完整的AGPL v3许可证: 许可证 | https://www.gnu.org/licenses/agpl-3.0.html

商业许可证

需要:

  • 💼 商业SaaS产品(专有)
  • 💼 销售包含DevStudio MCP的软件
  • 💼 保持您的修改专有
  • 💼 没有开源的企业部署

优点:

  • ✅ 无AGPL copyleft要求
  • ✅ 保持代码的专有性
  • ✅ 优先支持和更新
  • ✅ 商业用途赔偿
  • ✅ 提供自定义许可条款

定价:

  • 初创公司:收入\1000万美元收入-自定义条款

📧 商业许可联系人: nihitgupta.ng@outlook.com

详细信息: 许可证-商业.txt

______________________________________________________________________

为什么是双重许可?

我们相信开源,同时建立可持续的业务。AGPL v3确保社区从改进中受益,而商业许可允许企业在专有应用程序中使用DevStudio MCP。

🙏 致谢

📞 支持

  • 📧 电子邮件:nihitgupta.ng@outlook.com
  • 🐛 问题:
  • 💼 商业许可:nihitgupta.ng@outlook.com

______________________________________________________________________

内置❤️ 为开发人员创建令人惊叹的演示和教程

*第2/3阶段的功能(人工智能处理、内容生成、货币化)正在积极开发中,并保存在git branch中: archive/phase-2-3-ai-features*

目录标签

目录标签

PythonClaude语音音频屏幕录制本地部署演示自动化多显示器支持音频视频混合AI集成

支持客户端

Claude

接入字段

传输方式(transport,传输协议)

stdio

鉴权方式(authType,认证方式)

session

运行时(runtime,运行环境)

Python

工具数量(toolCount,工具数)

0

资源数量(resourceCount,资源数)

0

提示词数量(promptCount,提示词数)

0

权限和风险

stdiosession部署方式未说明

接入前请确认传输方式、认证方式和部署位置,并根据实际工具能力限制访问范围。

安装前确认

不要直接授予不必要的文件、网络或账号权限;先核对安装命令和配置内容。

来源信息

继续浏览同类 MCP