Token导航 LogoToken导航TokenDH.com
MCP Elevenlab Scribe Asr logo
音视频stdio官方级别未说明来源级核验

MCP Elevenlab Scribe Asr

MCP Server

ElevenLabs Scribe MCP Server 是一个基于模型控制协议(MCP)的语音转文字服务器,提供实时转录、文件转录和上下文管理功能。

工具数

0

提示词数

0

GitHub Stars

3

资源数

0
上下文管理Python音频处理

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

作者 / 组织

aromanstatue

提供方

aromanstatue

最后核验

2026/5/17 20:23

运行时

Python

快速接入

先看主来源和安装命令,再打开仓库或文档;下面只保留这个条目的关键接入事实。

命令预览

python -m venv venv

详细介绍

ElevenLabs Scribe MCP服务器

用于ElevenLabs Scribe语音转文本API的模型控制协议(MCP)服务器实现,通过高级上下文管理和双向流提供实时转录功能。

特性

  • 实时转录:直接从麦克风流式传输音频并获得即时转录
  • 基于文件的转录:上传音频文件以进行批处理
  • MCP协议支持:全面实施模型控制协议,以更好地进行上下文管理
  • WebSocket支持:实时双向通信
  • 上下文管理:保持对话上下文,以提高转录准确性
  • 多种音频格式:支持自动转换的各种音频格式
  • 语言检测:自动语言检测和置信度评分
  • 事件检测:识别语音和非语音音频事件

安装

  1. 克隆存储库:
git clone https://github.com/aromanstatue/MCP-Elevenlab-Scribe-ASR.git
cd MCP-Elevenlab-Scribe-ASR
  1. 创建并激活虚拟环境:
python -m venv venv
source venv/bin/activate  # On Windows: venv\Scripts\activate
  1. 安装依赖项:
pip install -e .
  1. 创建一个 .env 使用ElevenLabs API密钥文件:
ELEVENLABS_API_KEY=your-api-key-here

用法

启动服务器

python -m elevenlabs_scribe_mcp_server.main

默认情况下,服务器将从端口8000(或下一个可用端口)启动。

使用示例客户端

  1. 文件转录:
python examples/client_example.py --file path/to/audio.wav
  1. 麦克风转录:
python examples/client_example.py --mic

API终点

  1. REST API:
  • POST /transcribe:上传音频文件进行转录
  • GET /health:健康检查端点
  1. WebSocket API:
  • ws://localhost:8000/ws/transcribe:实时音频转录

MCP协议

服务器使用以下消息类型实现模型控制协议(MCP):

  1. INIT:初始化新的转录会话
  2. START:开始音频流
  3. AUDIO:发送音频数据
  4. TRANSCRIPTION:接收转录结果
  5. ERROR:错误消息
  6. STOP:结束音频流
  7. DONE:完成会话

发展

运行测试

pytest tests/

项目结构

elevenlabs-scribe-mcp-server/
├── elevenlabs_scribe_mcp_server/
│   ├── __init__.py
│   ├── main.py              # FastAPI server
│   └── mcp/
│       ├── __init__.py
│       ├── protocol.py      # MCP protocol handler
│       ├── types.py         # Protocol types
│       └── elevenlabs.py    # ElevenLabs implementation
├── examples/
│   └── client_example.py    # Example client
├── tests/
│   └── test_transcribe.py   # Test suite
├── pyproject.toml           # Project metadata
└── README.md

需求

  • Python 3.8+
  • 快速 API
  • 乌维科恩
  • PyAudio(用于麦克风支持)
  • 意图tp
  • python dotenv
  • 媒染剂

贡献

  1. 分叉存储库
  2. 创建功能分支(git checkout -b feature/amazing-feature)
  3. 提交您的更改(git commit -m 'Add amazing feature')
  4. 推到分支(git push origin feature/amazing-feature)
  5. 打开拉取请求

许可证

MIT许可证-有关详细信息,请参阅许可证文件。

致谢

  • ElevenLabs凭借其卓越的Scribe API
  • 用于现代web框架的FastAPI
  • Python社区,提供令人惊叹的工具和库

目录标签

目录标签

上下文管理Python音频处理语音转文字本地部署实时转录WebSocket

接入字段

传输方式(transport,传输协议)

stdio

鉴权方式(authType,认证方式)

none

运行时(runtime,运行环境)

Python

工具数量(toolCount,工具数)

0

资源数量(resourceCount,资源数)

0

提示词数量(promptCount,提示词数)

0

权限和风险

stdionone部署方式未说明

接入前请确认传输方式、认证方式和部署位置,并根据实际工具能力限制访问范围。

安装前确认

不要直接授予不必要的文件、网络或账号权限;先核对安装命令和配置内容。

来源信息

继续浏览同类 MCP