Visara-可视化MCP服务器
Visara是一个符合模型上下文协议(MCP)的视觉分析服务器,通过官方MCP协议提供图像处理功能。它可以分析图像、提取文本内容、理解场景,并为前端开发工作流程提供详细描述。
特性
- MCP协议合规性:完全符合模型上下文协议规范,使用官方
@modelcontextprotocol/sdk - 图像分析:分析图像并提取详细信息,包括对象、文本和场景理解
- 前端开发支持:UI/UX分析和前端开发的专门提示
- 本地文件路径支持:自动将本地文件路径转换为base64数据URL
- 生产就绪:包括Docker支持、健康检查和缓存
- Qwen VL Plus集成:连接到Qwen-VL Plus多模式API,用于高级图像分析
安装
git clone
cd visara
npm install用法
发展
# Build the project
npm run build
# Start the server
npm start服务器将在以下时间可用 http://localhost:9451.
码头工人
# Copy environment variables
cp .env.example .env
# Edit .env with your Qwen-VL API key
# Build and run with Docker Compose
docker-compose up --buildMCP端点
GET /health-健康检查端点GET /tools-列出可用工具GET /resources-列出可用资源GET /prompts-列出可用提示POST /-用于工具调用的主MCP端点POST /images/upload-用于直接图像处理的文件上传端点
工具
analyze_image
分析图像并提取详细信息。
参数:
imageUrl(字符串,必填):要分析的图像的URL或本地文件路径imageBase64(字符串,可选):Base64编码的图像数据prompt(字符串,可选):图像分析的自定义提示model(字符串,可选):要使用的模型(默认值:qwen-vl-plus)temperature(数字,可选):发电温度(0.0-1.0)maxTokens(数字,可选):响应的最大令牌数
提示
- 详细描述:获取图像中所有可见元素的详细描述
- 前端分析:分析UI/UX原型并提取组件结构、布局和样式信息
- 反应堆组件发电:基于UI原型生成React组件结构
- css_style_提取:提取详细的CSS样式、颜色、排版和间距
- ui_组件_库存:创建原型中存在的所有UI组件和元素的清单
- 响应式设计分析:分析响应式设计方面和断点
- 对象检测:识别并列出图像中的所有对象及其位置
- 文本提取:从图像中提取所有可见文本
- 场景理解:提供对场景背景的高层次理解
环境变量
QWEN_VL_API_KEY:您的Qwen-VL API密钥来自https://dashscope.console.aliyun.com/apiKeyQWEN_VL_API_BASE_URL:Qwen-VL API基本URL(默认值:https://dashscope.aliyuncs.com/api/v1/services/aigc/multimodal-generation)PORT:服务器端口(默认值:9451)HOST:服务器主机(默认值:0.0.0.0)CACHE_TTL:缓存生存时间(秒)(默认值:3600)MAX_FILE_SIZE:上传的最大文件大小(以字节为单位)(默认值:10485760=10MB)ALLOWED_MIME_TYPES:允许上传文件的MIME类型(默认:image/jpeg、image/png、image/webp)
许可证
麻省理工学院
