Token导航 LogoToken导航TokenDH.com
待分类敏感数据github未标认证来源可访问许可证需确认审计通过

volcengine-video-understandingvolcengine 视频理解

Agent Skill

用于辅助视频生成、动画合成、脚本化剪辑或 Remotion 等视频项目开发。它适合让 Agent 组织镜头、生成素材说明、维护合成代码或排查渲染问题。使用时需要确认分辨率、时长、素材路径和导出格式;涉及外部素材、人物肖像或商业发布时,应先核对版权授权和内容审核要求。

总安装

4,654

周安装

192

GitHub Stars

218

下载量

1,521
CodexClaudeCursorGemini CLI

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

GitHub

来源数

2

许可证

unknown

最后核验

2026-05-01

来源状态

来源可访问

安装方式

通过对话安装

复制提示词发给支持本地命令或 Skills 的 AI 助手,先确认命令和权限,再让它执行。

请帮我安装这个 Agent Skill:volcengine-video-understanding(volcengine 视频理解)
来源仓库:https://github.com/freestylefly/canghe-skills
仓库路径:skills/volcengine-video-understanding
安装命令:
npx skills add https://github.com/freestylefly/canghe-skills --skill volcengine-video-understanding
安装前请先检查当前环境是否支持对应 CLI,并向我确认将要执行的命令、安装目录、联网范围和文件读写权限;确认后再执行。

命令行安装

复制命令到本机终端执行。该命令会通过 npx skills 从第三方来源获取 Skill;本站只展示命令,不托管安装包,也不自动执行。

skills.shnpx skills
npx skills add https://github.com/freestylefly/canghe-skills --skill volcengine-video-understanding

简介

用于辅助视频生成和动画合成处理。volcengine-video-understanding 属于待分类类 Skill,可作为该场景下的辅助能力补充。

  • 适合组织镜头、生成素材说明或维护合成代码。
  • 通过 GitHub 安装,支持多种 Agent 宿主环境。
  • 需确认分辨率、时长和导出格式限制。
  • 涉及人物肖像或商业发布时应核对版权要求。

SKILL.md

火山视频理解

使用字节跳动火山方舟视频理解 API(doubao-seed-2-0-pro-260215 等模型)对视频进行深度理解和分析。

推荐方式:Files API 上传 + Responses API 分析

  • 支持最大 512MB 视频文件
  • 自动视频预处理(FPS采样)
  • 文件可重复使用(存储7天)

功能

  • 视频上传:通过 Files API 上传本地视频(推荐,最大512MB)
  • 内容理解:分析视频场景、人物、动作、情感
  • 视频问答:基于视频内容回答用户问题
  • 视频描述:自动生成视频描述和摘要

前置要求

需要设置 ARK_API_KEY 环境变量。

配置方式(推荐)

  1. 复制配置模板:
cp .canghe-skills/.env.example .canghe-skills/.env
  1. 编辑 .canghe-skills/.env 文件,填写你的 API Key:
ARK_API_KEY=your-actual-api-key-here

或使用环境变量

export ARK_API_KEY="your-api-key"

加载优先级

  1. 系统环境变量 (process.env)
  2. 当前目录 .canghe-skills/.env
  3. 用户主目录 ~/.canghe-skills/.env

使用方法

1. 基础视频分析(Files API 方式 - 推荐)

cd ~/.openclaw/workspace/skills/volcengine-video-understanding
python3 scripts/video_understand.py /path/to/video.mp4 "描述这个视频的内容"

2. 视频问答

python3 scripts/video_understand.py /path/to/video.mp4 "视频中出现了哪些人物?"

3. 情感分析

python3 scripts/video_understand.py /path/to/video.mp4 "分析视频中人物的情感变化"

4. 指定模型和帧率

python3 scripts/video_understand.py /path/to/video.mp4 "总结视频要点" \
  --model doubao-seed-2-0-pro-260215 \
  --fps 2

5. 保存结果到文件

python3 scripts/video_understand.py /path/to/video.mp4 "描述视频" --output result.json

参数说明

参数默认值说明
video_path必填视频文件路径
instruction必填分析指令/问题
--modeldoubao-seed-2-0-pro-260215模型 ID
--fps1视频采样帧率(预处理)
--output-结果输出文件路径

支持的模型

  • doubao-seed-2-0-pro-260215 (默认)
  • doubao-seed-2-0-lite-250728
  • doubao-seed-1-6-251015
  • 其他 Seed 系列视频理解模型

分析示例

示例 1:视频内容描述

python3 scripts/video_understand.py ~/Desktop/video.mp4 "详细描述这个视频的内容,包括场景、人物和动作"

示例 2:视频摘要

python3 scripts/video_understand.py ~/Desktop/video.mp4 "用3句话总结这个视频的要点"

示例 3:动作识别

python3 scripts/video_understand.py ~/Desktop/video.mp4 "视频中的人物在做什么动作?按时间顺序描述"

示例 4:场景分析

python3 scripts/video_understand.py ~/Desktop/video.mp4 "分析视频中的场景变化和环境特征"

技术细节

调用流程

  1. 上传视频:通过 Files API 上传本地视频文件,指定 FPS 预处理配置
  2. 等待处理:等待视频预处理完成(状态变为 processed)
  3. 创建任务:调用 Responses API 进行视频理解
  4. 获取结果:返回分析结果

API 格式

Files API 上传

curl https://ark.cn-beijing.volces.com/api/v3/files \
  -H "Authorization: Bearer $ARK_API_KEY" \
  -F 'purpose=user_data' \
  -F 'file=@video.mp4' \
  -F 'preprocess_configs[video][fps]=1'

Responses API 分析

{
  "model": "doubao-seed-2-0-pro-260215",
  "input": [
    {
      "role": "user",
      "content": [
        {
          "type": "input_video",
          "file_id": "file-xxxx"
        },
        {
          "type": "input_text",
          "text": "用户指令"
        }
      ]
    }
  ]
}

FPS 设置建议

FPS适用场景
0.3-0.5慢节奏视频、静态场景、节省token
1一般视频分析(默认)
2-3快速动作、细节分析

限制

  • 视频格式:MP4(推荐)、MOV、AVI
  • 文件大小:最大 512MB(Files API 方式)
  • 存储时间:上传的文件默认存储 7 天
  • 处理时间:根据视频长度和复杂度,通常 10-60 秒

Python API 使用

from scripts.video_understand import analyze_video

result = analyze_video(
    file_path="/path/to/video.mp4",
    instruction="描述视频内容",
    model="doubao-seed-2-0-pro-260215",
    fps=1
)

# 提取回答
text = ""
for item in result.get("output", []):
    if item.get("type") == "message":
        for content in item.get("content", []):
            if content.get("type") == "output_text":
                text = content.get("text", "")
                break

print(text)

错误处理

常见错误及解决方案:

错误原因解决方案
API Key 错误未设置或错误检查 ARK_API_KEY 环境变量
文件不存在路径错误检查文件路径
上传失败文件过大或格式不支持检查文件大小(<512MB)和格式
处理超时视频过长或复杂缩短视频或降低 FPS

参考文档

适合场景

01

用户想查找某类 Agent Skill 时

02

需要根据任务场景推荐可安装能力包时

03

需要对比不同来源的安装命令和来源信息时

能力概览

能力 1

按任务关键词查找相关 Skills

能力 2

展示可复制的安装命令

能力 3

保留来源站点、仓库和原始说明,方便继续核验

能力 4

展示第三方安全扫描或审计结果

安装后应在对应宿主中按原始 README 的触发条件使用;具体调用方式请以来源页面和 README 为准。

平台分布

Codex

36.82%
按下载量换算560

Claude

32.36%
按下载量换算492

Cursor

18.83%
按下载量换算286

Gemini CLI

9.83%
按下载量换算150

安全审计

Gen Agent Trust Hub

通过

Socket

通过

Snyk

通过

权限和风险

敏感数据

该 Skill 可能接触密钥、Token、环境变量或敏感配置,应进入高风险复核队列,默认不自动发布。

安装前确认

本站仅展示第三方公开信息,不托管安装包,不提供自动安装或运行环境。安装前应自行审查源码、依赖和命令行为。当前只有一个来源,正式发布前建议补源仓库或其他目录站核验。

来源信息

继续浏览同类 Skills