Cantonese.ai MCP服务器

一 MCP(模型上下文协议)服务器 它为 文本到语音 和 语音转文本 转换使用 营地.ai API此服务器设计为与以下设备一起运行 mcp dev.
______________________________________________________________________
✨ 特性
- 文本转语音工具:将粤语或英语文本转换为高质量音频。
- 语音转文本工具:将音频文件转录为文本。
- 现代工具:设置为
uv用于快速包管理。 - 易于集成:与任何兼容MCP的客户端(例如LLM代理)连接。
- 安全:您的
cantonese.aiAPI密钥作为一个环境变量被安全地处理。
______________________________________________________________________
🚀 入门指南
先决条件
- Python 3.8+
uv:我们建议使用uv用于Python包管理。
安装
- 克隆存储库:
git clone
cd cantonese-ai-mcp-server- 创建并激活虚拟环境:
uv venv
source .venv/bin/activate- 安装依赖项:
此项目使用 uv 从同步依赖关系 pyproject.toml.
uv sync- 设置API密钥:
您将需要来自的API密钥 cantonese.ai.将API密钥导出为环境变量。您可以将此添加到您的 .bashrc 或 .zshrc 用于持久化的文件。
export CANTONESE_AI_API_KEY="your-api-key-here"运行服务器
使用以下命令启动MCP开发服务器。它将关注以下方面的变化 server.py 并自动重新加载。
uv run mcp dev server.py您应该看到一个输出,指示服务器已启动并可用,通常在 http://127.0.0.1:6274.
或
运行服务器并在Claude Desktop中使用
uv run server.py请查看 面向服务器开发人员 关于如何设置与Cladue Desktop的连接。
🛠️ 使用工具
服务器运行后,它将公开两个工具。
工具: text_to_speech
将文本字符串转换为音频文件。
论据:
-text (string,必填):要转换为语音的文本。 -voice (字符串,可选,默认值:“默认”):用于语音合成的语音。 -language (字符串,可选,默认:“广东话”):文本的语言。可以是“广东话”或“英语”。 -output_filename (string,必填):保存音频的文件名(例如。, output.mp3).
调用示例:
{
"tool": "text_to_speech",
"arguments": {
"text": "你好世界",
"output_filename": "hello_world.mp3"
}
}成功响应:
{
"success": true,
"message": "Audio file saved as hello_world.mp3"
}工具: speech_to_text
将音频文件转录为文本。
论据:
input_filename (string,必填):要转录的本地音频文件的路径(例如。, audio.wav).
调用示例:
{
"tool": "speech_to_text",
"arguments": {
"input_filename": "audio.wav"
}
}成功响应:
该工具将返回一个JSON对象,其中包含来自API的转录详细信息。
{
"success": true,
"result": {
"text": "你好世界",
"confidence": 0.95,
"language": "cantonese",
"duration": 2.3,
"timestamp": "2025-06-02T11:22:00Z"
}
}📜 许可证
此项目根据MIT许可证获得许可-请参阅 LICENSE 文件以获取详细信息。
