Token导航 LogoToken导航TokenDH.com
Media Generator MCP logo
音视频stdio官方级别未说明来源级核验

Media Generator MCP

MCP Server

一个基于先进AI技术的服务器,用于从文本描述生成和编辑图像及视频,支持完整的文本到视频工作流。

工具数

4

提示词数

0

GitHub Stars

0

资源数

0
AI生成PythonClaudeClaude

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

作者 / 组织

lele1983

提供方

lele1983

最后核验

2026/5/17 20:19

运行时

Python

快速接入

先看主来源和安装命令,再打开仓库或文档;下面只保留这个条目的关键接入事实。

命令预览

python -m venv venv

详细介绍

媒体生成器MCP

一个MCP(模型上下文协议)服务器,用于使用最先进的人工智能生成图像和视频。

功能

  • 图像生成通过 OpenRouter 使用 Nano Banana Pro (Gemini 3 Pro Image Preview) 从文本描述创建图像
  • 图像编辑使用自然语言指令编辑现有图像
  • 动画 视频通过 fal.ai 使用 Kling 2.6 Pro 将静态图像转换为视频
  • 工作流完成直接从文本生成视频(文本→图像→视频)

使用模型

提供者模型
图像生成/编辑OpenRoutergoogle/gemini-3-pro-image-preview (Nano Banana Pro)
动画视频fal.aifal-ai/kling-video/v2.6/pro/image-to-video

要求

安装

1. 克隆或下载项目

cd /path/to/media-generator-mcp

2. 创建虚拟环境 (推荐)

python -m venv venv
source venv/bin/activate  # Linux/macOS
# oppure
.\venv\Scripts\activate   # Windows

3. 安装依赖关系

pip install -r requirements.txt

4. 配置API密钥

cp .env.example .env
# Modifica .env con le tue chiavi API

或者导出环境变量:

export OPENROUTER_API_KEY="sk-or-v1-..."
export FAL_KEY="..."

Claude 桌面配置

添加到您的 claude_desktop_config.json:

{
  "mcpServers": {
    "media-generator": {
      "command": "python",
      "args": ["/path/to/media-generator-mcp/server.py"],
      "env": {
        "OPENROUTER_API_KEY": "sk-or-v1-...",
        "FAL_KEY": "..."
      }
    }
  }
}

使用紫外线(替代)

{
  "mcpServers": {
    "media-generator": {
      "command": "uv",
      "args": [
        "--directory", "/path/to/media-generator-mcp",
        "run", "server.py"
      ],
      "env": {
        "OPENROUTER_API_KEY": "sk-or-v1-...",
        "FAL_KEY": "..."
      }
    }
  }
}

可用工具

1. image_generate - 从文本生成图像

从详细的文本描述创建图像。

参数 :

  • prompt (required): 图片说明
  • aspect_ratio: 1:1, 16:9, 9:16, 4:3, 21:9 (默认值: 1:1)
  • image_size: 1K, 2K, 4K (默认值: 2K)
  • style_prompt额外的风格说明

例如:

Genera un'immagine di una citta futuristica al tramonto con grattacieli di vetro e macchine volanti

2. image_edit - 图像编辑

按照文本说明编辑现有图像。

参数 :

  • image_urlimage_base64 (必填): 要编辑的图像
  • edit_instructions (需要):修改什么
  • aspect_ratio, image_size如上所述

例如:

Modifica l'immagine cambiando il cielo in un tramonto drammatico con colori arancioni e viola

3. video_animate - 视频中的灵魂图像

将静态图像转换为动画视频。

参数 :

  • image_url (required): 要动画的图像 URL
  • prompt (required): 想要的动作描述
  • duration: 510 secondi(默认值: 5)
  • generate_audio生成同步音频(默认: true)
  • negative_prompt: 避免什么

例如:

Anima questa immagine con un lento zoom della camera, nuvole che si muovono nel cielo

4. media_generate -工作流完成文本到视频

仅从文本生成完整视频。

参数 :

  • prompt (required) 场景描述
  • animation_prompt动画的具体说明
  • duration: 510 第二道菜
  • generate_audio:通用音频
  • aspect_ratio, image_size, style_prompt

例如:

Crea un video di un gatto seduto su un davanzale che guarda la pioggia fuori dalla finestra.
Il gatto gira lentamente la testa e sbatte le palpebre.

估计成本

操作大致成本
图像生成~$0.15
视频5s无音频~$0.35
视频5s对比音频~0.70美元
视频10s无音频~$0.70
视频10秒对比音频~1.40美元

输出

图片

图像以格式返回 base64 PNG您可以通过解码base64来保存它们:

import base64
with open("image.png", "wb") as f:
    f.write(base64.b64decode(image_base64))

视频

视频返回为 直接 URL MP4文件(托管在fal.ai)。URL有时限。

故障排除

错误“找不到OPENROUTER_API_KEY”

确保设置了环境变量或文件 .env.

错误“未找到FAL_KEY”

检查 fal.ai 密钥的配置。

错误 401/403

API密钥可能无效或没有必要的权限。

错误 402

贷款不足。重新加载您的 OpenRouter 或 fal.ai 帐户。

视频生成过程中超时

视频可能需要30-120秒。如果超时持续,请尝试:

  • 将持续时间缩短至 5 秒
  • 关闭音频
  • 使用更简单的图像

许可证

MIT许可证

目录标签

目录标签

AI生成PythonClaude本地部署图像编辑视频动画文本到视频

支持客户端

Claude

接入字段

传输方式(transport,传输协议)

stdio

鉴权方式(authType,认证方式)

none

运行时(runtime,运行环境)

Python

工具数量(toolCount,工具数)

4

资源数量(resourceCount,资源数)

0

提示词数量(promptCount,提示词数)

0

权限和风险

stdionone部署方式未说明

接入前请确认传输方式、认证方式和部署位置,并根据实际工具能力限制访问范围。

安装前确认

不要直接授予不必要的文件、网络或账号权限;先核对安装命令和配置内容。

来源信息

继续浏览同类 MCP