Token导航 LogoToken导航TokenDH.com
Gimmick Vision MCP logo
运维云端stdio官方级别未说明来源级核验

Gimmick Vision MCP

MCP Server

一个将Claude Code和其他代理连接到本地OpenAI兼容视觉模型的MCP服务器,支持图像分析和OCR功能。

工具数

3

提示词数

0

GitHub Stars

2

资源数

0
图像分析JavaScriptClaudeClaude

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

作者 / 组织

castellotti

提供方

castellotti

最后核验

2026/5/17 20:20

运行时

Docker

快速接入

先看主来源和安装命令,再打开仓库或文档;下面只保留这个条目的关键接入事实。

命令预览

docker run --rm -i \

详细介绍

噱头视觉mcp

一个MCP服务器,将Claude Code和其他代理连接到任何本地OpenAI兼容的视觉模型。

传递一个图像URL和一个提示——噱头视觉将请求转发到您的本地视觉服务器,并返回文本响应。适用于通过兼容OpenAI的API(llama.cpp、Ollama、vLLM等)提供的任何模型。

gimmick-vision-mcp demo

gimmick-search-mcp + gimmick-vision-mcp

为什么存在

Claude Code(尤其是在运行Qwen3 Coder Next等本地LLM时)没有内置的视觉功能。 gimmick-vision 向MCP工具集添加了三个图像分析工具,将视觉请求路由到单独的本地模型(例如Qwen2.5-VL-7B),而无需任何云API调用。

提供的工具

工具说明
analyze_image分析URL中的单个图像。返回提示的描述或答案。
compare_images最多发送8张图像进行组合分析或比较。
read_image_textOCR从图像中提取所有可见文本。

Docker快速入门

docker run --rm -i \
  -e VISION_API_BASE=http://host.docker.internal:8081/v1 \
  -e VISION_MODEL=qwen2.5-vl-7b \
  ghcr.io/castellotti/gimmick-vision-mcp:latest

添加到您的 .mcp.json:

{
  "mcpServers": {
    "gimmick-vision": {
      "command": "docker",
      "args": [
        "run", "--rm", "-i",
        "-e", "VISION_API_BASE=http://host.docker.internal:8081/v1",
        "-e", "VISION_MODEL=qwen2.5-vl-7b",
        "ghcr.io/castellotti/gimmick-vision-mcp:latest"
      ]
    }
  }
}

Docker 镜像

每次推送时,该图像都会发布到GitHub容器注册表 main 在版本标签上:

docker pull ghcr.io/castellotti/gimmick-vision-mcp:latest

从源头构建

git clone https://github.com/castellotti/gimmick-vision-mcp
cd gimmick-vision-mcp
docker build -t ghcr.io/castellotti/gimmick-vision-mcp:latest .

在当地建设

npm install
npm run build
node build/index.js

环境变量

变量默认值描述
VISION_API_BASEhttp://host.docker.internal:8081/v1愿景API服务器的基本URL
VISION_MODELqwen2.5-vl-7b在API请求中发送的模型别名
VISION_TIMEOUT60000请求超时(毫秒)
GIMMICK_PANEL_URLhttp://host.docker.internal:6081/api/vision可选:将结果推送到噱头搜索控制面板进行实时预览

运行本地视觉服务器

任何接受OpenAI兼容的服务器 image_url 在聊天完成工作。以llama.cpp为例:

llama-server \
  -m Qwen2.5-VL-7B-Instruct-Q4_K_M.gguf \
  --mmproj mmproj-Qwen2.5-VL-7B-Instruct-Q8_0.gguf \
  --port 8081 \
  --host 0.0.0.0 \
  -ngl 999

在macOS/Metal上,完全GPU卸载(-ngl 999)效果很好。在主LLM已经填充VRAM的CUDA机器上,在CPU上运行视觉模型(-ngl 0).

与噱头搜索集成

如果你使用 噱头搜索mcp,噱头视觉可以将分析结果推送到其控制面板侧边栏。集 GIMMICK_PANEL_URL (默认指向端口6081上的噱头搜索控制面板)。故障会被自动忽略,因此该工具可以独立工作。

许可证

麻省理工学院

目录标签

目录标签

图像分析JavaScriptClaude视觉模型本地部署OCRAI工具

支持客户端

Claude

接入字段

传输方式(transport,传输协议)

stdio

鉴权方式(authType,认证方式)

none

运行时(runtime,运行环境)

Docker

工具数量(toolCount,工具数)

3

资源数量(resourceCount,资源数)

0

提示词数量(promptCount,提示词数)

0

权限和风险

stdionone部署方式未说明

接入前请确认传输方式、认证方式和部署位置,并根据实际工具能力限制访问范围。

安装前确认

不要直接授予不必要的文件、网络或账号权限;先核对安装命令和配置内容。

来源信息

继续浏览同类 MCP