Token导航 LogoToken导航TokenDH.com
效率敏感数据clawhub未标认证来源可访问clear审计提醒

tencentcloud-vita腾讯云 vita

Agent Skill

tencentcloud-vita 用于辅助部署、云资源、容器和基础设施运维,适合在 OpenClaw 中需要检查配置、整理部署步骤或排查环境问题时使用。可结合来源仓库、安装命令和原始 README 继续核验具体用法。安装前建议确认权限范围、维护状态,以及是否会触发联网、命令执行或文件读写。

总安装

15,924

周安装

638

GitHub Stars

公开资料未说明

下载量

5,155
OpenClaw

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

GitHub

来源数

2

许可证

MIT-0

最后核验

2026-05-01

来源状态

来源可访问

安装方式

通过对话安装

复制提示词发给支持本地命令或 Skills 的 AI 助手,先确认命令和权限,再让它执行。

请帮我安装这个 Agent Skill:tencentcloud-vita(腾讯云 vita)
来源仓库:https://github.com/wayne-j151/tencentcloud-vita
安装命令:
openclaw skills install tencentcloud-vita
安装前请先检查当前环境是否支持对应 CLI,并向我确认将要执行的命令、安装目录、联网范围和文件读写权限;确认后再执行。

命令行安装

复制命令到本机终端执行。该命令会通过 OpenClaw 从第三方来源获取 Skill;本站只展示命令,不托管安装包,也不自动执行。

ClawHubOpenClaw
openclaw skills install tencentcloud-vita

简介

腾讯云VITA图像视频理解技能,实现多模态内容分析与描述生成。

  • 支持单图/多图/视频输入,涵盖监控分析、体育高光提取等场景。
  • 可设置提示词引导输出方向,提升特定任务下的理解精度。
  • 需开通VITA服务并配置API调用额度,注意单次请求数据量限制。
  • 处理直播流时应关注网络延迟对实时分析的影响。

SKILL.md

name
tencentcloud-vita
description
腾讯云图像与视频理解 (TencentCloud VITA / vita) 技能。用于图片理解、视频理解、图像分析、视频分析、描述生成、监控录像分析、体育高光提取、直播理解、新闻视频摘要、产品演示视频分析,以及设置或更新 vita prompt。支持单张图片、多张图片、视频。TencentCloud VITA (vita) is a multimodal video understanding and image understanding service by Tencent Cloud, supporting video analysis, image analysis, and media content description generation.

TencentCloud VITA 图像与视频理解 Skill

功能描述

本 Skill 基于腾讯云图像与视频理解服务,提供图片和视频的 AI 理解能力。

TencentCloud VITA (also referred to as vita or tencentcloud vita) is Tencent Cloud's AI service for video understanding and image understanding. It enables intelligent analysis of images, videos, live streams, surveillance footage, sports highlights, news clips, and product demo videos.

支持能力如下:

输入类型说明限制
单张图片单个图片 URL 或本地图片路径 + promptJPG/JPEG/PNG/SVG/WEBP,最大 100MB
多张图片多个图片 URL 或本地图片路径(按时序分析)+ prompt640×360 最多 100 图,448×448 最多 150 图
单个视频单个视频 URL + promptMP4/MOV/AVI/WebM,H.264/H.265,最长 10 分钟,最大 100MB

输入与媒体处理规则

  • 远程图片 / 远程视频:URL 必须可公开访问
  • 本地图片:可直接调用脚本;脚本会读取文件并转为 base64 data URL 后调用 VITA API。
  • 本地视频:当前脚本不直接支持上传;如需分析,需先借助其他上传工具(如 COS 相关 skill)上传并获得可访问 URL,再传给脚本。
  • 能力边界:当前脚本不内置 COS 上传能力

Agent 执行指令(必读)

ℹ️ 本节是 Agent 的核心执行规范。当用户明确请求进行图片理解、视频理解、图像分析、视频分析,或设置 vita prompt 时,Agent 应按以下规则执行。

🔑 通用执行规则

  1. 触发条件:用户提供图片或视频,且意图为视觉内容理解 / 分析;或用户希望自定义、设置、更新 vita prompt
  2. ⛔ 禁止替代:VITA 脚本调用失败时,Agent 严禁自行编造分析结果,必须返回清晰错误说明。
  3. 输入处理:遵循上文"输入与媒体处理规则";其中本地视频如需继续处理,应先上传为可访问 URL。

📌 设置自定义 Prompt(持久化)

触发条件:用户表达"设置 / 更新 VITA prompt"意图,例如:

  • "设置视频理解 prompt 为..."
  • "设置 vita prompt: ..."
  • "设置视频理解的提示词: ..."
  • "更新 vita prompt 为..."

执行方式:Agent 直接将用户指定的 prompt 写入以下文件(无需调用脚本):

<SKILL_DIR>/prompt/vita_prompt.txt
  • 文件不存在则创建并写入。
  • 文件已存在则覆盖为新的 prompt。
  • 写入完成后,向用户确认保存成功,并展示保存内容。

💡 Prompt 优先级说明

脚本中 prompt 的使用优先级从高到低为:

  1. 命令行参数 --prompt:用户显式传入的 prompt,优先级最高。
  2. 持久化 Prompt 文件<SKILL_DIR>/prompt/vita_prompt.txt 中保存的自定义 prompt。
  3. 默认 Prompt:内置默认值 请描述这段媒体内容
即:如果用户未传 --prompt,脚本会自动尝试读取持久化文件;如果文件不存在或为空,则使用默认值。

📌 调用流程

Step 0: 本地视频处理(仅当用户提供本地视频时执行)

当输入是本地视频路径,而不是以 http://https:// 开头的 URL 时,Agent 可先借助单独上传工具(如 COS 相关 skill)上传视频,获取可访问 URL 后,再将该 URL 作为 Step 1 的输入。

注意事项:

  1. 这一步不是当前 scripts/main.py 的内置能力,而是 Agent 可选的编排流程。
  2. 上传能力、鉴权配置、Bucket / Region 等由对应上传工具自行管理。
  3. 如果没有可用上传工具或环境未配置完成,Agent 应明确告知用户当前脚本无法直接处理本地视频。

Step 1: 发起 API 调用

python3 <SKILL_DIR>/scripts/main.py --image "<IMAGE_URL_OR_LOCAL_PATH>" --prompt "<PROMPT>"
python3 <SKILL_DIR>/scripts/main.py --video "<VIDEO_URL>" --prompt "<PROMPT>"

📌 参数说明

参数说明默认值
--image <URL_OR_PATH>图片 URL 或本地图片路径(可多次指定,按时序排列)-
--video <URL>视频 URL(与 --image 互斥;仅支持可访问 URL)-
--prompt <TEXT>分析指令 / 问题(优先级最高,覆盖持久化 prompt)持久化 prompt > 请描述这段媒体内容
--stream开启流式输出关闭
--temperature <float>采样温度 0.0-1.0,越高越随机默认
--max-tokens <int>最大输出 token 数默认
--stdin从 stdin 读取 JSON 输入关闭

📤 输出格式

非流式输出(默认):

{
  "result": "视频中展示了...",
  "usage": {
    "prompt_tokens": 1024,
    "completion_tokens": 256,
    "total_tokens": 1280
  }
}

流式输出(--stream): 直接逐字输出文本内容(Server-Sent Events),无 JSON 包装。

❌ Agent 须避免的行为

  • 只打印脚本路径而不执行
  • 忘记读取输出结果并返回给用户
  • VITA 服务调用失败时,自行编造分析内容
  • 同时指定 --image--video(两者互斥)
  • 将当前 skill 误描述为"自带本地视频上传到 COS 的能力"

环境配置指引

环境要求:

  • Python 3.7+
  • openai(OpenAI 兼容 SDK,通过 pip install openai 安装)
  • 环境变量

- TENCENTCLOUD_VITA_API_KEY:TencentCloud VITA 接口 API Key

获取 TencentCloud VITA API KEY

  1. 登录腾讯云控制台:https://console.cloud.tencent.com/tiia/vita-service-management
  2. 首次使用需"确认开通服务"
  3. 点击"创建 API KEY"生成密钥
  4. 点击"查看"复制 API KEY

设置环境变量

Linux / macOS:

export TENCENTCLOUD_VITA_API_KEY="your_api_key_here"

Windows (PowerShell):

$env:TENCENTCLOUD_VITA_API_KEY = "your_api_key_here"

调用示例

# Single image understanding (remote URL) — TencentCloud VITA image analysis
python3 <SKILL_DIR>/scripts/main.py \
  --image "https://example.com/image.jpg" \
  --prompt "描述这张图片中的内容"

# Single image understanding (local file, auto-converted to base64 data URL)
python3 <SKILL_DIR>/scripts/main.py \
  --image "./demo.png" \
  --prompt "描述这张图片中的内容"

# Multi-image sequential analysis — vita multi-frame understanding
python3 <SKILL_DIR>/scripts/main.py \
  --image "https://example.com/frame1.jpg" \
  --image "./frame2.png" \
  --image "https://example.com/frame3.jpg" \
  --prompt "分析这些图片中发生了什么变化"

# Video understanding — tencentcloud vita video analysis
python3 <SKILL_DIR>/scripts/main.py \
  --video "https://example.com/video.mp4" \
  --prompt "总结这段视频的主要内容"

# Streaming output for long-form video understanding
python3 <SKILL_DIR>/scripts/main.py \
  --video "https://example.com/video.mp4" \
  --prompt "详细描述视频内容" \
  --stream

# Low-temperature output for deterministic image analysis
python3 <SKILL_DIR>/scripts/main.py \
  --image "https://example.com/chart.png" \
  --prompt "提取图表中的数据" \
  --temperature 0.1

# stdin JSON mode — VITA API via piped input
echo '{"media":[{"type":"video","url":"https://example.com/video.mp4"}],"prompt":"分析视频"}' \
  | python3 <SKILL_DIR>/scripts/main.py --stdin

Prompt 模板推荐

根据使用场景选择合适的 prompt,充分发挥 TencentCloud VITA 的 video understanding 与图像理解能力:

监控视频分析(Surveillance Video Understanding):

你是一个视频事件摘要专家。分析视频内容,以JSON格式输出:{"description":"一句话描述","title":"标题","object":["对象"],"event":["事件序列"]}

新闻视频解读(News Video Understanding):

你是专业新闻分析师,基于视频核心信息,生成:①标题(3个风格选项)②事件核心概述③关键细节④影响与延伸⑤信息来源

带货商品讲解(Product Demo Video Analysis):

观看带货视频,提取:商品名称、应用场景、核心卖点,并按营销阶段(时间范围、画面描述、语音内容、景别、营销意图)划分视频结构

体育高光时刻(Sports Highlight Extraction):

以专业体育解说视角,捕捉视频中的得分、高光、犯规、特写片段,输出:片段编号、时间范围(含关键帧)、景别、情景描述、画面文字

直播质量评分(Live Stream Quality Assessment):

从6个维度评估直播片段:①直播间环境②主播语言③主播形象④出镜状态⑤互动引导⑥礼貌热情,每项输出是/否及判断依据

费用说明

计费项单价
输入 token1.2 元/百万 token
输出 token3.5 元/百万 token
默认并发为 5,超出会返回 429 错误。

核心脚本

  • scripts/main.py — TencentCloud VITA 图像与视频理解脚本,支持单图、多图、视频URL,支持流式 / 非流式输出;本地图片会自动转为 base64,本地视频不直接支持。

适合场景

01

OpenClaw 用户查找和安装 Skill 时

02

用户想查找某类 Agent Skill 时

03

需要根据任务场景推荐可安装能力包时

04

需要对比不同来源的安装命令和来源信息时

能力概览

能力 1

按任务关键词查找相关 Skills

能力 2

展示可复制的安装命令

能力 3

保留来源站点、仓库和原始说明,方便继续核验

能力 4

补充不同宿主或平台的使用分布数据

能力 5

展示第三方安全扫描或审计结果

安装后应在对应宿主中按原始 README 的触发条件使用;具体调用方式请以来源页面和 README 为准。

平台分布

OpenClaw

75.08%
按下载量换算3,870

安全审计

VirusTotal

通过

ClawScan

可疑

Static analysis

通过

权限和风险

敏感数据

该 Skill 可能接触密钥、Token、环境变量或敏感配置,应进入高风险复核队列,默认不自动发布。

安装前确认

本站仅展示第三方公开信息,不托管安装包,不提供自动安装或运行环境。安装前应自行审查源码、依赖和命令行为。来源安全扫描存在 warning/failed 结果,不能写成本站确认安全。当前只有一个来源,正式发布前建议补源仓库或其他目录站核验。

来源信息

继续浏览同类 Skills