Speech MCP是一个为Goose设计的语音交互扩展,提供实时音频处理、语音识别、文本转语音及现代音频可视化界面。
安装状态
已补齐
工具数量
0
GitHub Stars
81
命令预览
pip install speech-mcp[kokoro] # Basic Kokoro support with English
Speech MCP是一个为Goose设计的语音交互扩展,提供实时音频处理、语音识别、文本转语音及现代音频可视化界面。
安装状态
已补齐
工具数量
0
GitHub Stars
81
命令预览
pip install speech-mcp[kokoro] # Basic Kokoro support with English
为Claude Code提供双向语音交互功能,通过本地运行的语音转文本和文本转语音工具实现与Claude的自然语言对话。
工具数量
2
GitHub Stars
14
MCP-Audio是一款符合AIO-2030标准的MCP插件,通过Audio语音识别API实现语音到文字的转换,支持多格式输入和JSON-RPC结构化输出。
安装状态
已补齐
工具数量
2
GitHub Stars
8
命令预览
python -m venv venv && source venv/bin/activate
支持多种语音识别服务的视频处理工具,包括Whisper本地模型、简影和B站剪辑的在线服务。
工具数量
0
GitHub Stars
7
一个用于录制音频并使用OpenAI的Whisper模型进行转录的MCP服务器,可作为Goose自定义扩展或独立MCP服务器使用。
安装状态
已补齐
工具数量
3
GitHub Stars
6
命令预览
pip install -e .
一个基于Python的服务器,提供语音转文本、说话人识别、文本翻译和文本摘要等功能。
安装状态
已补齐
工具数量
5
GitHub Stars
2
命令预览
python -m venv venv
IntelliGlow是一个基于MCP协议的智能灯光控制系统,支持通过UDP网络通信控制智能灯泡,具备语音命令、AI推理和直接硬件控制功能。
安装状态
已补齐
工具数量
8
GitHub Stars
1
命令预览
pip install -e .
一个本地MCP服务器,提供语音转文本和文本转语音工具,适用于Claude Code的语音交互。
工具数量
5
GitHub Stars
1
提供通过stdio和MCP模式的语音识别和文本提取功能,支持从文件和base64编码数据中识别语音,并生成结构化结果。
安装状态
已补齐
工具数量
4
GitHub Stars
0
命令预览
pip install -r requirements.txt
基于Faster Whisper的高性能语音识别MCP服务器,提供高效的音频转录功能。
安装状态
已补齐
工具数量
0
GitHub Stars
0
命令预览
pip install -r requirements.txt
全面解析Audio Transcriber (OpenAI Whisper)MCP Server的核心功能、安装配置和实用案例。作为顶级Model Context Protocol服务器,Audio Transcriber (OpenAI Whisper)能让AI助手访问实时数据、执行操作,为您提供更智能的工作体验和自动化解决方案。
全面解析Fast Whisper MCP ServerMCP Server的核心功能、安装配置和实用案例。作为顶级Model Context Protocol服务器,Fast Whisper MCP Server能让AI助手访问实时数据、执行操作,为您提供更智能的工作体验和自动化解决方案。
安装状态
已补齐
命令预览
pip install -r requirements.txt
全面解析MCP AudioMCP Server的核心功能、安装配置和实用案例。作为顶级Model Context Protocol服务器,MCP Audio能让AI助手访问实时数据、执行操作,为您提供更智能的工作体验和自动化解决方案。
安装状态
已补齐
命令预览
pip install -r requirements.txt
全面解析MCP Speaker DiarizationMCP Server的核心功能、安装配置和实用案例。作为顶级Model Context Protocol服务器,MCP Speaker Diarization能让AI助手访问实时数据、执行操作,为您提供更智能的工作体验和自动化解决方案。
安装状态
已补齐
命令预览
pip install -r requirements.txt
全面解析Speech Interface (Faster Whisper)MCP Server的核心功能、安装配置和实用案例。作为顶级Model Context Protocol服务器,Speech Interface (Faster Whisper)能让AI助手访问实时数据、执行操作,为您提供更智能的工作体验和自动化解决方案。
基于NVIDIA Parakeet TDT 0.6B V2模型的音频和视频文件转录服务,支持多种格式转换和详细时间戳输出。
工具数量
0
GitHub Stars
11
基于GLM-ASR-Nano的高精度语音识别服务,支持17种语言,提供Web UI、REST API和SSE流式传输功能。
安装状态
已补齐
工具数量
0
GitHub Stars
7
命令预览
docker run -d --gpus all -p 7860:7860 neosun/glm-asr:v2.0.1
mcp-claude-say 是一个为 Claude Code 提供的语音交互服务,支持文本到语音(TTS)和语音到文本(STT)功能,实现完整的语音对话体验。
安装状态
已补齐
工具数量
7
GitHub Stars
7
命令预览
pip install chatterbox-tts uvicorn fastapi torchaudio
GPU加速的说话人分割、转录和情感识别服务,支持REST API和WebSocket流式传输。
安装状态
已补齐
工具数量
11
GitHub Stars
5
命令预览
python -m venv venv && source venv/bin/activate
一款利用AI技术将语音录音转换为可操作任务、日历事件和结构化笔记的工具,支持Claude AI和MCP协议。
工具数量
0
GitHub Stars
2