噱头视觉mcp
一个MCP服务器,将Claude Code和其他代理连接到任何本地OpenAI兼容的视觉模型。
传递一个图像URL和一个提示——噱头视觉将请求转发到您的本地视觉服务器,并返回文本响应。适用于通过兼容OpenAI的API(llama.cpp、Ollama、vLLM等)提供的任何模型。
gimmick-search-mcp + gimmick-vision-mcp
为什么存在
Claude Code(尤其是在运行Qwen3 Coder Next等本地LLM时)没有内置的视觉功能。 gimmick-vision 向MCP工具集添加了三个图像分析工具,将视觉请求路由到单独的本地模型(例如Qwen2.5-VL-7B),而无需任何云API调用。
提供的工具
| 工具 | 说明 |
|---|---|
analyze_image | 分析URL中的单个图像。返回提示的描述或答案。 |
compare_images | 最多发送8张图像进行组合分析或比较。 |
read_image_text | OCR从图像中提取所有可见文本。 |
Docker快速入门
docker run --rm -i \
-e VISION_API_BASE=http://host.docker.internal:8081/v1 \
-e VISION_MODEL=qwen2.5-vl-7b \
ghcr.io/castellotti/gimmick-vision-mcp:latest添加到您的 .mcp.json:
{
"mcpServers": {
"gimmick-vision": {
"command": "docker",
"args": [
"run", "--rm", "-i",
"-e", "VISION_API_BASE=http://host.docker.internal:8081/v1",
"-e", "VISION_MODEL=qwen2.5-vl-7b",
"ghcr.io/castellotti/gimmick-vision-mcp:latest"
]
}
}
}Docker 镜像
每次推送时,该图像都会发布到GitHub容器注册表 main 在版本标签上:
docker pull ghcr.io/castellotti/gimmick-vision-mcp:latest从源头构建
git clone https://github.com/castellotti/gimmick-vision-mcp
cd gimmick-vision-mcp
docker build -t ghcr.io/castellotti/gimmick-vision-mcp:latest .在当地建设
npm install
npm run build
node build/index.js环境变量
| 变量 | 默认值 | 描述 |
|---|---|---|
VISION_API_BASE | http://host.docker.internal:8081/v1 | 愿景API服务器的基本URL |
VISION_MODEL | qwen2.5-vl-7b | 在API请求中发送的模型别名 |
VISION_TIMEOUT | 60000 | 请求超时(毫秒) |
GIMMICK_PANEL_URL | http://host.docker.internal:6081/api/vision | 可选:将结果推送到噱头搜索控制面板进行实时预览 |
运行本地视觉服务器
任何接受OpenAI兼容的服务器 image_url 在聊天完成工作。以llama.cpp为例:
llama-server \
-m Qwen2.5-VL-7B-Instruct-Q4_K_M.gguf \
--mmproj mmproj-Qwen2.5-VL-7B-Instruct-Q8_0.gguf \
--port 8081 \
--host 0.0.0.0 \
-ngl 999在macOS/Metal上,完全GPU卸载(-ngl 999)效果很好。在主LLM已经填充VRAM的CUDA机器上,在CPU上运行视觉模型(-ngl 0).
与噱头搜索集成
如果你使用 噱头搜索mcp,噱头视觉可以将分析结果推送到其控制面板侧边栏。集 GIMMICK_PANEL_URL (默认指向端口6081上的噱头搜索控制面板)。故障会被自动忽略,因此该工具可以独立工作。
许可证
麻省理工学院
