Token导航 LogoToken导航TokenDH.com
图像处理敏感数据clawhub未标认证来源可访问clear审计提醒

zhipu-image-generator智浦图像生成器

Agent Skill

用于辅助图像生成、图片编辑、视觉素材处理或图像模型工作流。它适合让 Agent 根据文本生成图片、处理背景、整理视觉提示词或调用相关图像工具。使用时需要确认输入图片、版权来源、输出格式和模型限制;涉及人物、品牌、商品或公开展示素材时,应额外核对授权、真实性和内容合规边界。

总安装

11,238

周安装

473

GitHub Stars

2

下载量

3,935
OpenClaw

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

GitHub

来源数

2

许可证

MIT-0

最后核验

2026-05-01

来源状态

来源可访问

安装方式

通过对话安装

复制提示词发给支持本地命令或 Skills 的 AI 助手,先确认命令和权限,再让它执行。

请帮我安装这个 Agent Skill:zhipu-image-generator(智浦图像生成器)
来源仓库:https://github.com/henrybao91/zhipu-image-generator
安装命令:
openclaw skills install zhipu-image-generator
安装前请先检查当前环境是否支持对应 CLI,并向我确认将要执行的命令、安装目录、联网范围和文件读写权限;确认后再执行。

命令行安装

复制命令到本机终端执行。该命令会通过 OpenClaw 从第三方来源获取 Skill;本站只展示命令,不托管安装包,也不自动执行。

ClawHubOpenClaw
openclaw skills install zhipu-image-generator

简介

通过 BigModel API 生成图像并将其作为聊天图像发送(例如飞书)。当用户要求创建具有特定样式/尺寸的单个图片时调用。

SKILL.md

name
image-generator
description
Generate images via BigModel APIs and send them as chat images (e.g. Feishu). Invoke when user asks to create a single picture with specific style/size.
metadata
{ "openclaw": { "emoji": "🖼️", "requires": { "env": ["ZHIPU_API_KEY"] }, "primaryEnv": "ZHIPU_API_KEY" } }

CogView-3-Flash Skill

基于智谱/BigModel 的 cogview-3-flash 文生图接口,提供快速单张图片生成能力。

Features

  • 使用 https://open.bigmodel.cn/api/paas/v4/images/generations 接口
  • 支持通过环境变量 ZHIPU_API_KEY 配置鉴权 Token
  • 支持 cogview-3-flashglm-image 两类模型
  • 作为 OpenClaw Skill 使用:当用户在对话中请求生成图片时,由 Agent 调用本技能,自动执行 scripts/generate.py,根据提示词和尺寸生成图片并返回本地文件路径
  • 简单参数:提示词、尺寸、水印开关

Setup

  1. 从对应平台控制台获取 API Key/Token
  2. 在终端中设置环境变量:
export ZHIPU_API_KEY="你的 API Key"

或在工具配置中以同名变量注入。

Models & Sizes

在脚本中通过 --model 选择模型:

  • cogview:对应 cogview-3-flash(默认)
  • glm:对应 glm-image

各模型推荐尺寸与限制:

  • glm-image 推荐枚举值:1280x1280(默认), 1568x1056, 1056x1568, 1472x1088, 1088x1472, 1728x960, 960x1728

自定义尺寸: 长宽推荐在 1024px-2048px 范围内, 最大像素数不超过 2^22,长宽需为 32 的整数倍。

  • 其它模型(如 cogview-3-flash)推荐枚举值:1024x1024(默认), 768x1344, 864x1152, 1344x768, 1152x864, 1440x720, 720x1440

自定义尺寸: 长宽需在 512px-2048px 范围内, 最大像素数不超过 2^21,长宽需为 16 的整数倍。

Usage

命令行生成图片

python scripts/generate.py \
  "两只可爱的小猫咪,坐在阳光明媚的窗台上,背景是蓝天白云。" \
  --model cogview \
  --size 1024x1024 \
  --no-watermark \
  --output cats.png

参数说明

  • prompt:必填,中文或英文提示词
  • --model:模型选择,cogview(默认)/glm
  • --size:图片尺寸,不传则使用所选模型默认尺寸
  • --watermark:开启水印(默认开启)
  • --no-watermark:关闭水印
  • --output / -o:指定输出文件名,默认自动生成

API 行为说明

  • 接口返回 JSON,格式类似:
{
  "created": 1773146620,
  "data": [
    { "url": "https://.../image.png" }
  ],
  "id": "20260310204340ad2bd838dcb64c7f",
  "request_id": "20260310204340ad2bd838dcb64c7f"
}
  • 本 Skill 会自动解析 data[0].url,下载图片并保存到本地。

在 Feishu 中的使用(给 Agent 的操作指引)

当用户在 Feishu 对话中请求你生成图片时,请按下面步骤操作:

  1. 使用系统运行工具,在 {baseDir} 目录下执行命令,根据用户的提示词和期望尺寸构造参数,例如:

- python {baseDir}/scripts/generate.py "<用户提示词>" --model cogview --size "<宽x高>" --no-watermark --output "/root/.openclaw/workspace/images/cogview-{时间戳}.png"

  1. 从脚本标准输出中找到形如 ✅ 图片已保存: /path/to/image.png 的一行,并解析出其中的本地图片路径。
  2. 使用 Feishu 的发送图片能力,将该图片文件直接作为图片消息发送到当前会话,而不是只把本地路径文本返回给用户。
  3. 在文字回复中简单说明图片信息(模型、尺寸、提示词等),同时附上生成的图片。

示例

# 使用 cogview-3-flash,默认尺寸
python scripts/generate.py "一幅赛博朋克城市夜景,霓虹灯与雨夜" -o cyberpunk.png

# 使用 glm-image,自定义尺寸 + 关闭水印
python scripts/generate.py \
  "可爱风格的猫咪插画" \
  --model glm \
  --size 1280x1280 \
  --no-watermark

适合场景

01

OpenClaw 用户查找和安装 Skill 时

02

用户想查找某类 Agent Skill 时

03

需要根据任务场景推荐可安装能力包时

04

需要对比不同来源的安装命令和来源信息时

能力概览

能力 1

按任务关键词查找相关 Skills

能力 2

展示可复制的安装命令

能力 3

保留来源站点、仓库和原始说明,方便继续核验

能力 4

补充不同宿主或平台的使用分布数据

能力 5

展示第三方安全扫描或审计结果

安装后应在对应宿主中按原始 README 的触发条件使用;具体调用方式请以来源页面和 README 为准。

平台分布

OpenClaw

73.1%
按下载量换算2,876

安全审计

VirusTotal

通过

ClawScan

可疑

Static analysis

通过

权限和风险

敏感数据

该 Skill 可能接触密钥、Token、环境变量或敏感配置,应进入高风险复核队列,默认不自动发布。

安装前确认

本站仅展示第三方公开信息,不托管安装包,不提供自动安装或运行环境。安装前应自行审查源码、依赖和命令行为。来源安全扫描存在 warning/failed 结果,不能写成本站确认安全。当前只有一个来源,正式发布前建议补源仓库或其他目录站核验。

来源信息

继续浏览同类 Skills