谷歌图像生成MCP服务器
一种模型上下文协议(MCP)服务器,使用谷歌的Gemini模型提供图像生成功能。此服务器包括一个强大的管道,用于在生成图像之前验证和增强提示。
特性
- 评估:检查用户的提示是否足够描述性,以便生成高质量的图像。
- 增强:自动重写和改进提示,以遵循图像生成模型的最佳实践。
- 执行:使用
gemini-3-pro-image-preview模型生成图像。 - 基于任务的工作流:实现MCP任务接口,用于处理长时间运行的操作。
先决条件
- Node.js(建议使用v18或更高版本)
- 包子 (用于建筑和运行)
- 启用Gemini API的谷歌云项目
- API Gemini API密钥
安装
- 克隆存储库:
git clone
cd google-image-generation-mcp- 安装依赖项:
bun install- 构建项目:
bun run build配置
您需要设置 GOOGLE_API_KEY 环境变量。
此外,您可以启用实验 任务API 通过设置 ENABLE_TASKS=true。默认情况下,服务器使用标准的MCP工具API。
GOOGLE_API_KEY:您的Google Gemini API密钥。ENABLE_TASKS:(可选)设置为true以启用用于异步图像生成的实验任务API。
与Claude Desktop一起使用
将以下配置添加到您的 claude_desktop_config.json 文件(通常位于 ~/Library/Application Support/Claude/claude_desktop_config.json 在macOS或 %APPDATA%\Claude\claude_desktop_config.json 在Windows上):
{
"mcpServers": {
"google-image-generation": {
"command": "bun",
"args": ["run", "/absolute/path/to/google-image-generation-mcp/build/index.js"],
"env": {
"GOOGLE_API_KEY": "your-api-key-here"
}
}
}
}确保更换 /absolute/path/to/google-image-generation-mcp 使用克隆存储库的实际路径。
用法
此服务器公开了一个名为的MCP工具 generate_image MCP客户端(如Claude)可以使用它。
默认情况下,此工具使用标准MCP工具API(同步)。如果启用任务API(ENABLE_TASKS=true),另一个实验版本 generate_image 将支持异步执行和状态轮询。
当您要求模型生成图像时,服务器将:
- 评估 你的提示,以确保它足够详细。
- 增强 提示您针对图像生成模型对其进行优化。
- 执行 生成图像的精细提示。
该工具使用 gemini-3-pro-image-preview 模型,需要描述性提示。如果您的提示过于模糊,该工具将返回一个错误,建议您提供更多详细信息。
输出
生成的图像保存在 generated_images 服务器工作目录中的目录。该工具返回base64编码的图像数据和保存图像的文件路径。
原理
服务器遵循 Triple E(EEE)工作流程 为了确保高质量的图像生成:
- 评估:使用快速检查
gemini-3-flash-preview以确定提示是否足够描述性。如果没有,它会返回反馈,要求提供更多详细信息。 - 增强:如果有效,提示将由专家提示工程师模型重写(也
gemini-3-flash-preview)包括基于既定最佳实践的照明、构图和风格的细节。 - 执行:精炼提示发送至
gemini-3-pro-image-preview以生成最终图像。
模型使用
- 评估和增强:
gemini-3-flash-preview-选择速度和推理能力。 - 执行:
gemini-3-pro-image-preview-谷歌最先进的图像生成模型。
发展
要在开发模式下运行服务器(如果您有支持它的设置)或重建:
bun run build
bun run start许可证
ISC
