Token导航 LogoToken导航TokenDH.com
效率权限需确认clawhub未标认证来源可访问clear审计通过

ollama-visionOllama vision 图像

Agent Skill

ollama-vision 用于处理图像、截图、视觉识别或图片素材相关工作,适合在 OpenClaw 中需要让 Agent 分析图片、整理视觉素材或辅助图像流程时使用。可结合来源仓库、安装命令和原始 README 继续核验具体用法。安装前建议确认权限范围、维护状态,以及是否会触发联网、命令执行或文件读写。

总安装

11,432

周安装

458

GitHub Stars

公开资料未说明

下载量

3,701
OpenClaw

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

GitHub

来源数

2

许可证

MIT-0

最后核验

2026-05-01

来源状态

来源可访问

安装方式

通过对话安装

复制提示词发给支持本地命令或 Skills 的 AI 助手,先确认命令和权限,再让它执行。

请帮我安装这个 Agent Skill:ollama-vision(Ollama vision 图像)
来源仓库:https://github.com/lzm2023/ollama-vision
安装命令:
openclaw skills install ollama-vision
安装前请先检查当前环境是否支持对应 CLI,并向我确认将要执行的命令、安装目录、联网范围和文件读写权限;确认后再执行。

命令行安装

复制命令到本机终端执行。该命令会通过 OpenClaw 从第三方来源获取 Skill;本站只展示命令,不托管安装包,也不自动执行。

ClawHubOpenClaw
openclaw skills install ollama-vision

简介

本地调用Ollama qwen3-vl:4b模型自动压缩并分析图片,支持描述、OCR文字提取和自定义信息抽取。

SKILL.md

Ollama Vision Skill

本地视觉分析技能,调用 Ollama 的 qwen3-vl:4b 模型分析图片。

Description

此技能允许在保留 Kimi 作为主对话模型的前提下,使用本地部署的 Ollama 视觉模型(qwen3-vl:4b)分析图片内容。支持 OCR、图片描述、文字提取等功能。

Requirements

  • Ollama 必须已安装并运行
  • qwen3-vl:4b 模型必须已下载(或自动下载)
  • Python 3.8+ 环境
  • Pillow 库(用于图片压缩:pip install Pillow

Features

  • 自动压缩:超过 2MB 的图片会自动压缩后再分析
  • 多模式分析:describe(描述)、ocr(文字提取)、extract(自定义提取)
  • 临时文件清理:压缩产生的临时文件会自动删除
  • 质量优先:优先降低 JPEG 质量,必要时缩小尺寸

Tools

analyze_image

分析图片内容,支持多种分析模式。

参数:

  • image_path (string, required): 图片文件的完整路径
  • mode (string, optional): 分析模式,可选值:

- "describe" - 详细描述图片内容(默认) - "ocr" - 提取图片中的所有文字 - "extract" - 根据自定义提示词提取特定信息

  • prompt (string, optional): 当 mode="extract" 时的自定义提示词

返回:

  • 分析结果的文本字符串

示例:

# 描述图片
analyze_image(image_path="C:\\path\\	o\\image.jpg")

# OCR 提取文字
analyze_image(image_path="C:\\path\\	o\\image.jpg", mode="ocr")

# 自定义提取
analyze_image(
    image_path="C:\\path\\	o\\image.jpg", 
    mode="extract", 
    prompt="提取图片中的表格数据"
)

Usage Flow

  1. 用户发送图片消息
  2. Agent 检测到图片,调用 analyze_image 工具
  3. 工具调用本地 Ollama qwen3-vl:4b 模型分析
  4. 返回分析结果给用户

Notes

  • 首次使用 qwen3-vl:4b 时会自动下载模型(约 2-3GB)
  • 分析时间取决于图片大小和复杂度(通常 5-30 秒)
  • 需要足够的显存(4B 模型建议 6GB+)

适合场景

01

OpenClaw 用户查找和安装 Skill 时

02

用户想查找某类 Agent Skill 时

03

需要根据任务场景推荐可安装能力包时

04

需要对比不同来源的安装命令和来源信息时

能力概览

能力 1

按任务关键词查找相关 Skills

能力 2

展示可复制的安装命令

能力 3

保留来源站点、仓库和原始说明,方便继续核验

能力 4

补充不同宿主或平台的使用分布数据

能力 5

展示第三方安全扫描或审计结果

安装后应在对应宿主中按原始 README 的触发条件使用;具体调用方式请以来源页面和 README 为准。

平台分布

OpenClaw

89.01%
按下载量换算3,294

安全审计

VirusTotal

通过

ClawScan

通过

Static analysis

通过

权限和风险

权限需确认

当前来源未能明确判断权限范围,默认进入异常复核队列。

安装前确认

本站仅展示第三方公开信息,不托管安装包,不提供自动安装或运行环境。安装前应自行审查源码、依赖和命令行为。当前只有一个来源,正式发布前建议补源仓库或其他目录站核验。

来源信息

继续浏览同类 Skills