Token导航 LogoToken导航TokenDH.com
图像处理需要联网clawhub未标认证来源可访问clear审计提醒

image-gen-skill图像生成技能

Agent Skill

用于辅助图像生成、图片编辑、视觉素材处理或图像模型工作流。它适合让 Agent 根据文本生成图片、处理背景、整理视觉提示词或调用相关图像工具。使用时需要确认输入图片、版权来源、输出格式和模型限制;涉及人物、品牌、商品或公开展示素材时,应额外核对授权、真实性和内容合规边界。

总安装

47,638

周安装

1,946

GitHub Stars

公开资料未说明

下载量

15,412
OpenClaw

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

GitHub

来源数

2

许可证

MIT-0

最后核验

2026-05-01

来源状态

来源可访问

安装方式

通过对话安装

复制提示词发给支持本地命令或 Skills 的 AI 助手,先确认命令和权限,再让它执行。

请帮我安装这个 Agent Skill:image-gen-skill(图像生成技能)
来源仓库:https://github.com/zweien/image-gen-skill
安装命令:
openclaw skills install image-gen-skill
安装前请先检查当前环境是否支持对应 CLI,并向我确认将要执行的命令、安装目录、联网范围和文件读写权限;确认后再执行。

命令行安装

复制命令到本机终端执行。该命令会通过 OpenClaw 从第三方来源获取 Skill;本站只展示命令,不托管安装包,也不自动执行。

ClawHubOpenClaw
openclaw skills install image-gen-skill

简介

纳米香蕉图像生成与编辑技巧。支持文生图和图生图,根据文字描述或图使用AI生成/编辑图像,自动压缩大图,保存到workspace/img目录,并直接在飞书展示。触发场景:用户要求生成图片、画图、AI绘图参考、创建图像、修改图片、基于图片生成、图生图。

SKILL.md

name
image-gen
description
|

Nano-banana 图像生成与编辑 Skill

使用 Nano-banana-3.1-Flash API 进行图像生成与编辑,支持:

  • 文生图 (text-to-image): 根据文字描述生成图像
  • 图生图 (image-to-image): 基于参考图生成新图像

自动压缩超过 1MB 的图片,保存到 workspace,并直接在飞书中展示。

配置

在workspace目录下创建 .env 文件:

# .env
IMAGE_API_BASE_URL=https://api.imyaigc.top
IMAGE_API_KEY=your-api-key-here
IMAGE_MODEL=gemini-3.1-flash-image-preview
IMAGE_SIZE=2K
IMAGE_ASPECT_RATIO=1:1

图片保存位置

所有生成的图片保存在:

~/.openclaw/workspace/img/

文件名格式:image_YYYYMMDD_HHMMSS.png

压缩规则:

  • 原始图片保存为:image_YYYYMMDD_HHMMSS_original.png
  • 如果原图 > 1MB,自动压缩并保存为:image_YYYYMMDD_HHMMSS.png
  • 发送到时使用压缩后的版本

使用方法

1. 文生图 (Text-to-Image)

直接告诉我要生成什么图片:

示例:

  • "生成一张夕阳下的海滩图片"
  • "画一只可爱的猫咪"
  • "创建一个赛博朋克风格的大龙虾,16:9 比例"

2. 图生图 (Image-to-Image)

提供参考图和修改描述:

示例:

  • "基于这张图,改成水彩风格"
  • "把这张图改成夜景"
  • "参考这张图,生成一个类似风格的建筑"
  • "把这张照片变成油画风格"

工作流程:

  1. 用户提供参考图(发送图片)
  2. 下载图片并转为 base64
  3. 调用 API 时传入 image 参数
  4. 返回基于参考图生成的新图像

工作流程

文生图流程

  1. 解析参数

- 提取提示词 - 识别宽高比参数(如 "16:9"、"1:1")

  1. 调用 API
   curl -X POST "${IMAGE_API_BASE_URL}/v1/images/generations" \
       -H "Authorization: Bearer ${IMAGE_API_KEY}" \
       -H "Content-Type: application/json" \
       -d '{
           "model": "'"${IMAGE_MODEL}"'",
           "prompt": "描述内容",
           "response_format": "url",
           "aspect_ratio": "16:9"
       }'

图生图流程

  1. 获取参考图

- 用户发送图片 - 下载图片并转为 base64

  1. 调用 API
   curl -X POST "${IMAGE_API_BASE_URL}/v1/images/generations" \
       -H "Authorization: Bearer ${IMAGE_API_KEY}" \
       -H "Content-Type: application/json" \
       -d '{
           "model": "'"${IMAGE_MODEL}"'",
           "prompt": "修改描述(如:改为水彩风格)",
           "response_format": "url",
           "aspect_ratio": "16:9",
           "image": ["data:image/png;base64,iVBORw0KGgo..."]
       }'
  1. 获取图片 URL

- 从响应中提取 data[0].url

  1. 下载并保存原始图片
   OUTPUT_DIR=~/.openclaw/workspace/img
   TIMESTAMP=$(date +%Y%m%d_%H%M%S)
   ORIGINAL_FILE="${OUTPUT_DIR}/image_${TIMESTAMP}_original.png"
   FINAL_FILE="${OUTPUT_DIR}/image_${TIMESTAMP}.png"

   curl -o "$ORIGINAL_FILE" "$IMAGE_URL"
  1. 检查大小并压缩(如需要)
   FILE_SIZE=$(stat -f%z "$ORIGINAL_FILE" 2>/dev/null || stat -c%s "$ORIGINAL_FILE")
   MAX_SIZE=$((1024 * 1024))  # 1MB

   if [ "$FILE_SIZE" -gt "$MAX_SIZE" ]; then
       echo "图片超过 1MB,正在压缩..."
       python3 compress_image.py "$ORIGINAL_FILE" "$FINAL_FILE" 1
   else
       cp "$ORIGINAL_FILE" "$FINAL_FILE"
   fi
  1. 发送到飞书

如果在飞书对话中,注意以下发送方式

   message(
     action="send",
     channel="feishu",
     accountId="second",
     target="用户或群组ID",
     media="~/.openclaw/workspace/img/image_xxx.png"
   )

压缩工具

使用 compress_image.py 进行图片压缩:

# 用法
python3 compress_image.py <input> <output> [max_size_mb]

# 示例
python3 compress_image.py original.png compressed.png 1

压缩策略:

  1. 如果图片 ≤ 1MB,不压缩
  2. 如果图片 > 1MB:

- 逐步降低 JPEG 质量 (85 → 10) - 如果仍超过限制,缩小尺寸 (90% → 30%)

  1. 保留原始文件,压缩结果另存

支持的参数

宽高比 (aspect_ratio)

  • 1:1 - 正方形(默认)
  • 4:3, 3:4 - 标准比例
  • 16:9, 9:16 - 宽屏/竖屏
  • 2:3, 3:2 - 照片比例
  • 4:5, 5:4 - 接近正方形
  • 21:9 - 超宽屏
  • 1:4, 4:1 - 长条形
  • 8:1, 1:8 - 超长条形

图像尺寸 (image_size)

  • 1K - 适合快速预览
  • 2K - 推荐默认(默认)
  • 4K - 高清大图
  • 512px - 小图

参考图 (image)

  • 类型:字符串数组
  • 格式:URL 或 base64 编码(推荐 data:image/png;base64,... 格式)
  • 支持:单张或多张参考图

API 信息

  • Endpoint: POST /v1/images/generations
  • 认证: Authorization: Bearer {{YOUR_API_KEY}}
  • 模型: ${IMAGE_MODEL} (默认: gemini-3.1-flash-image-preview)
  • Base URL: https://api.imyaigc.top

完整请求参数

参数类型必填说明
modelstring模型名称
promptstring生成描述
response_formatstringurlb64_json
aspect_ratiostring宽高比
imagearray参考图数组(URL 或 base64)
image_sizestring图像尺寸(仅 nano-banana-2 支持)

目录结构

~/.openclaw/workspace/
├── img/                          # 生成的图片保存目录
│   ├── image_20260302_221900_original.png  # 原始图片
│   ├── image_20260302_221900.png           # 压缩后(用于发送)
│   └── ...
└── skills/
    └── image-gen/
        ├── SKILL.md              # 本说明文件
        ├── image-gen.sh          # 生成脚本
        ├── compress_image.py     # 压缩工具
        ├── .env                  # API 配置
        └── .env.example          # 配置示例

注意事项

  1. 图片必须保存在 ~/.openclaw/workspace/img/ 目录
  2. 超过 1MB 的图片会自动压缩后再发送到飞书
  3. 原始图片保留,方便后续使用
  4. 文件名使用时间戳避免冲突
  5. 提示词会自动翻译为英文以获得更好的生成效果
  6. API 调用可能需要 30-60 秒,请告知用户等待
  7. 图生图时:参考图会转为 base64 传入 API 的 image 参数

适合场景

01

文本生成图片

02

图片风格化

03

产品图和创意图

04

需要 FLUX 模型时

能力概览

能力 1

调用 FLUX 图像模型

能力 2

支持文本生图和图像改写

能力 3

覆盖 LoRA 或风格适配

能力 4

适合创意视觉生成

安装后应在对应宿主中按原始 README 的触发条件使用;具体调用方式请以来源页面和 README 为准。

平台分布

OpenClaw

77.3%
按下载量换算11,913

安全审计

VirusTotal

通过

ClawScan

可疑

Static analysis

通过

权限和风险

需要联网

该 Skill 可能需要联网访问来源站点、仓库或外部 API;具体网络访问范围需要结合源码和 README 复核。

安装前确认

本站仅展示第三方公开信息,不托管安装包,不提供自动安装或运行环境。安装前应自行审查源码、依赖和命令行为。来源安全扫描存在 warning/failed 结果,不能写成本站确认安全。当前只有一个来源,正式发布前建议补源仓库或其他目录站核验。

来源信息

继续浏览同类 Skills