Token导航 LogoToken导航TokenDH.com
Voice Assistant MCP Gemini logo
音视频未说明官方级别未说明来源级核验

Voice Assistant MCP Gemini

MCP Server

一款通过音频与用户交互并使用MCP工具执行操作的语音助手,支持语音转文本、文本转语音、后台监听命令检测以及Gemini API集成。

工具数

0

提示词数

0

GitHub Stars

0

资源数

0
语音识别Python语音音频

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

作者 / 组织

KJaybhaye

提供方

KJaybhaye

最后核验

2026/5/17 20:22

快速接入

先看主来源和安装命令,再打开仓库或文档;下面只保留这个条目的关键接入事实。

详细介绍

语音助手:MCP+Gemini

这是一个语音助手,可以通过音频与用户交互,并使用MCP工具执行操作。

特征:

  • MCP工具调用
  • 使用Whisper模型的语音转文本
  • 文本转语音
  • 助手的背景监听和指令检测
  • 使用Tkinter的用户界面
  • Gemini API支持
  • 无需按发送按钮即可继续聊天

注:

  • 要在GPU上运行Whisper model(用于将音频转录为文本),请安装PyTorch for GPU。 官方介绍
  • 创建一个 .env 文件并将您的Google API添加为“Google_API_KEY”变量
  • 要添加其他本地MCP文件,请修改server_config.json文件并提供目录的完整路径。例如
"mcpServers": {
    "ankiServer": {
      "command": "uv",
      "args": [
        "--directory",
        "Path to server directory",
        "run",
        "MCP_script.py"
      ]
    }
  }
  • 要更改Gemini模型、Whisper模型等,请进行修改 config.toml

目录标签

目录标签

语音识别Python语音音频语音助手本地部署MCP工具GeminiAPI自动化交互

接入字段

传输方式(transport,传输协议)

未说明

鉴权方式(authType,认证方式)

none

工具数量(toolCount,工具数)

0

资源数量(resourceCount,资源数)

0

提示词数量(promptCount,提示词数)

0

权限和风险

未说明none部署方式未说明

接入前请确认传输方式、认证方式和部署位置,并根据实际工具能力限制访问范围。

安装前确认

不要直接授予不必要的文件、网络或账号权限;先核对安装命令和配置内容。

仍需确认:installCommand

来源信息

继续浏览同类 MCP