Token导航 LogoToken导航TokenDH.com
MCPTTS (Invisibleacropolis Ops) logo
音视频stdio官方级别未说明来源级核验

MCPTTS (Invisibleacropolis Ops)

MCP Server

MCP TTS Server是一个本地运行的文本转语音服务器,利用现代神经TTS技术将文本输出转换为语音,支持多种情感表达和实时控制。

工具数

8

提示词数

0

GitHub Stars

0

资源数

0
语音音频PythonClaudeClaude DesktopClaude

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

作者 / 组织

invisibleacropolis-ops

提供方

invisibleacropolis-ops

最后核验

2026/5/17 20:23

快速接入

先看主来源和安装命令,再打开仓库或文档;下面只保留这个条目的关键接入事实。

命令预览

pip install -e .

详细介绍

MCP TTS服务器

本地运行的MCP(模型上下文协议)服务器,使LLM能够使用现代神经TTS技术将文本输出转换为语音。

特性

  • 🎙️ 神经TTS:使用Piper TTS的高质量文本转语音
  • 🎭 情感表达:支持8种情绪音调(中性、快乐、悲伤、愤怒、兴奋、冷静、恐惧、惊讶)
  • 实时控制:实时调整速度、音高和情绪强度
  • 🖥️ GUI监控:基于CustomTkinter的GUI,带有实时日志查看器
  • 🔧 广泛的日志记录:详细的调试输出,便于故障排除
  • 🔌 MCP兼容:与Claude Desktop、MCP Inspector和其他MCP客户端配合使用

安装

# Clone the repository
cd c:\GITHUB\MCPTTS

# Install with uv (recommended)
uv pip install -e .

# Or with pip
pip install -e .

快速开始

使用GUI运行(默认)

mcp-tts
# or
python -m mcp_tts.main

仅运行服务器(适用于MCP客户端)

mcp-tts --server
# or
mcp-tts-server

从克劳德桌面连接

添加到您的Claude Desktop MCP配置中:

{
  "mcpServers": {
    "tts": {
      "command": "uv",
      "args": ["run", "mcp-tts", "--server"]
    }
  }
}

MCP工具

工具说明
speak_text使用可配置参数将文本转换为语音
set_voice设置默认语音模型
set_emotion设定情绪表达和强度
list_voices列出可用的语音模型
clone_voice添加用于克隆的语音参考(Fish/XTS)
get_status获取当前TTS发动机状态
get_gpu_status获取GPU可用性和VRAM诊断
configure_tts更新TTS设置(速度、音高、音量)

示例用法

// Speak with happy emotion
speak_text("Hello! I'm so glad to meet you!", emotion="happy", intensity=0.8)

// Auto-route for low latency
speak_text("Quick preview", engine="auto", task="fast")

// Change voice
set_voice("en_US-joe-medium")

// Adjust speed and pitch
configure_tts(speed=1.2, pitch=0.1)

// Add a cloned voice reference (XTTS/Fish)
clone_voice("C:/voices/sample.wav", name="demo", prompt_text="Sample line", language="en")

// Stream in chunks (long text)
speak_text("Long text...", streaming=true, chunk_size=220)

配置

配置存储在 ~/.mcp-tts/config.json:

{
  "tts": {
    "voice": "en_US-amy-medium",
    "engine": "auto",
    "speed": 1.0,
    "pitch": 0.0,
    "emotion": "neutral",
    "emotion_intensity": 0.5
  },
  "audio": {
    "auto_play": true,
    "sample_rate": 22050,
    "effects_enabled": false,
    "normalize_audio": true,
    "compression_strength": 0.2,
    "reverb_wet": 0.1,
    "reverb_decay": 0.4
  }
}

发动机选择通过环境变量控制:

set MCP_TTS_ENGINE=fish

支持的发动机值: auto, fish, xtts, piper, system.

您还可以从GUI设置面板切换引擎或传递 enginespeak_text.

音频效果

通过设置启用音频管道 effects_enabled 在配置中。即使禁用效果,规范化也可以运行。

流媒体

使用 streaming=truechunk_size 将长文本分段流式传输,以便提前开始播放。

语音模型

语音模型存储在 ~/.mcp-tts/models/.从以下网址下载Piper语音: https://github.com/rhasspy/piper/releases

鱼语(OpenAudio S1 mini)

Fish Speech使用本地HTTP API服务器进行推理。在单独的终端中启动它:

python -m tools.api_server \
  --listen 127.0.0.1:8080 \
  --llama-checkpoint-path "checkpoints/openaudio-s1-mini" \
  --decoder-checkpoint-path "checkpoints/openaudio-s1-mini/codec.pth" \
  --decoder-config-name modded_dac_vq

然后用环境变量将MCP TTS指向API:

set FISH_SPEECH_API_URL=http://127.0.0.1:8080

启动MCP TTS时,您还可以自动启动Fish Speech API:

set FISH_SPEECH_REPO=C:\GITHUB\FishSpeechServer
mcp-tts

或者在CLI上传递repo路径:

mcp-tts --fish-repo C:\GITHUB\FishSpeechServer

XTTS-v2(通用TTS)

安装依赖项:

pip install -e ".[xtts,gpu]"

设置引擎和可选语言覆盖:

set MCP_TTS_ENGINE=xtts
set XTTS_LANGUAGE=en

使用 clone_voice 添加参考语音(XTTS需要参考样本)。

发展

# Install dev dependencies
uv pip install -e ".[dev]"

# Run tests
uv run pytest

# Run with verbose logging
mcp-tts --log-level DEBUG

许可证

麻省理工学院

目录标签

目录标签

语音音频PythonClaude文本转语音本地部署神经TTS实时控制情感表达语音克隆

支持客户端

Claude DesktopClaude

接入字段

传输方式(transport,传输协议)

stdio

鉴权方式(authType,认证方式)

none

工具数量(toolCount,工具数)

8

资源数量(resourceCount,资源数)

0

提示词数量(promptCount,提示词数)

0

权限和风险

stdionone部署方式未说明

接入前请确认传输方式、认证方式和部署位置,并根据实际工具能力限制访问范围。

安装前确认

不要直接授予不必要的文件、网络或账号权限;先核对安装命令和配置内容。

来源信息

继续浏览同类 MCP