Token导航 LogoToken导航TokenDH.com
MCP Video Recognition Server logo
音视频未说明官方级别未说明来源级核验

MCP Video Recognition Server

MCP Server

基于Google Gemini AI的MCP服务器,提供图像、音频和视频识别功能。

工具数

0

提示词数

0

GitHub Stars

10

资源数

0
TypeScriptCline语音音频ClineVS Code

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

作者 / 组织

mario-andreschak

提供方

mario-andreschak

最后核验

2026/5/17 20:20

快速接入

先看主来源和安装命令,再打开仓库或文档;下面只保留这个条目的关键接入事实。

详细介绍

MCP视频识别服务器

一个MCP(模型上下文协议)服务器,使用谷歌的Gemini AI提供图像、音频和视频识别工具。

特性

  • 图像识别:使用Google Gemini AI分析和描述图像
  • 音频识别:使用Google Gemini AI分析和转录音频
  • 视频识别:使用Google Gemini AI分析和描述视频

先决条件

  • Node.js 18或更高版本
  • Google Gemini API密钥

安装

手动安装

  1. 克隆存储库:
   git clone https://github.com/yourusername/mcp-video-recognition.git
   cd mcp-video-recognition
  1. 安装依赖项:
   npm install
  1. 构建项目:
   npm run build

安装在 流动

  1. 单击添加服务器
  2. 将GitHub URL复制并粘贴到流中
  3. 单击解析、克隆、安装、构建和保存。

通过配置文件安装

要通过配置文件将此MCP服务器与Cline或其他MCP客户端集成:

  1. 打开您的Cline设置:

- 在VS Code中,转到文件->首选项->设置 - 搜索“临床MCP设置” - 点击“在settings.json中编辑”

  1. 将服务器配置添加到 mcpServers 对象:
   {
     "mcpServers": {
       "video-recognition": {
         "command": "node",
         "args": [
           "/path/to/mcp-video-recognition/dist/index.js"
         ],
         "disabled": false,
         "autoApprove": []
       }
     }
   }
  1. 替换 /path/to/mcp-video-recognition/dist/index.js 与实际路径 index.js 项目目录中的文件。在Windows上对路径使用正斜杠(/)或双反斜杠(\\\\)。
  1. 保存设置文件。Cline应自动连接到服务器。

配置

使用环境变量配置服务器:

  • GOOGLE_API_KEY (必需):您的Google Gemini API密钥
  • TRANSPORT_TYPE:要使用的运输类型(stdiosse,默认为 stdio)
  • PORT:SSE传输的端口号(默认为3000)
  • LOG_LEVEL:日志记录级别(verbose, debug, info, warn, error,默认为 info)

用法

启动服务器

使用stdio传输(默认)

GOOGLE_API_KEY=your_api_key npm start

苏格兰和南方能源公司运输

GOOGLE_API_KEY=your_api_key TRANSPORT_TYPE=sse PORT=3000 npm start

使用工具

服务器提供了三个MCP客户端可以调用的工具:

图像识别

{
  "name": "image_recognition",
  "arguments": {
    "filepath": "/path/to/image.jpg",
    "prompt": "Describe this image in detail",
    "modelname": "gemini-2.0-flash"
  }
}

音频识别

{
  "name": "audio_recognition",
  "arguments": {
    "filepath": "/path/to/audio.mp3",
    "prompt": "Transcribe this audio",
    "modelname": "gemini-2.0-flash"
  }
}

视频识别

{
  "name": "video_recognition",
  "arguments": {
    "filepath": "/path/to/video.mp4",
    "prompt": "Describe what happens in this video",
    "modelname": "gemini-2.0-flash"
  }
}

刀具参数

所有工具都接受以下参数:

  • filepath (必需):要分析的媒体文件的路径
  • prompt (可选):自定义识别提示(默认为“描述此内容”)
  • modelname (可选):用于识别的Gemini模型(默认为“Gemini-2.0-flash”)

发展

以开发模式运行

GOOGLE_API_KEY=your_api_key npm run dev

项目结构

  • src/index.ts:入口点
  • src/server.ts:MCP服务器实现
  • src/tools/:工具实施
  • src/services/:服务实现(Gemini API)
  • src/types/:类型定义
  • src/utils/:实用功能

许可证

麻省理工学院

目录标签

目录标签

TypeScriptCline语音音频视频识别本地部署图像识别音频识别AI服务GeminiAI

支持客户端

ClineVS Code

接入字段

传输方式(transport,传输协议)

未说明

鉴权方式(authType,认证方式)

none

部署方式(deploymentType,部署类型)

remote-capable

工具数量(toolCount,工具数)

0

资源数量(resourceCount,资源数)

0

提示词数量(promptCount,提示词数)

0

权限和风险

未说明noneremote-capable

接入前请确认传输方式、认证方式和部署位置,并根据实际工具能力限制访问范围。

安装前确认

不要直接授予不必要的文件、网络或账号权限;先核对安装命令和配置内容。

仍需确认:installCommand

来源信息

继续浏览同类 MCP