Token导航 LogoToken导航TokenDH.com
开发敏感数据unknown未标认证来源可访问许可证需确认审计未展示

video-summary视频摘要

Agent Skill

用于辅助视频生成、动画合成、脚本化剪辑或 Remotion 等视频项目开发。它适合让 Agent 组织镜头、生成素材说明、维护合成代码或排查渲染问题。使用时需要确认分辨率、时长、素材路径和导出格式;涉及外部素材、人物肖像或商业发布时,应先核对版权授权和内容审核要求。

总安装

470

周安装

20

下载量

165
Local Agent

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

来源数

2

许可证

unknown

最后核验

2026-05-01

来源状态

来源可访问

安装方式

通过对话安装

复制提示词发给支持本地命令或 Skills 的 AI 助手,先确认命令和权限,再让它执行。

请帮我安装这个 Agent Skill:video-summary(视频摘要)
来源仓库:https://skills.volces.com
仓库路径:video-summary
安装命令:
安装前请先检查当前环境是否支持对应 CLI,并向我确认将要执行的命令、安装目录、联网范围和文件读写权限;确认后再执行。

命令行安装

复制命令到本机终端执行。当前暂无明确安装命令,请以来源页面说明为准。

简介

用于辅助视频生成、动画合成、脚本化剪辑或 Remotion 等视频项目开发。

  • 适合让 Agent 组织镜头、生成素材说明、维护合成代码或排查渲染问题。
  • 使用时需确认分辨率、时长、素材路径和导出格式,涉及外部素材或商业发布时核对版权与审核要求。
  • 安装方式未知,建议结合来源仓库和原始 README 进一步核验具体用法。
  • 注意权限范围和维护状态,避免触发联网、命令执行或文件读写风险。

SKILL.md

Video Summary Skill

Intelligent video summarization for multi-platform content. Supports Bilibili, Xiaohongshu, Douyin, YouTube, and local video files.

What It Does

  • Auto-detect platform from URL (Bilibili/Xiaohongshu/Douyin/YouTube)
  • Extract subtitles/transcripts using platform-specific methods
  • Generate structured summaries with key insights, timestamps, and actionable takeaways
  • Multi-format output (plain text, JSON, Markdown)
  • Direct LLM integration — outputs ready-to-use summaries
  • Automatic cleanup — no temp file leaks

Conversational Setup

After installation, OpenClaw will guide you through configuration step by step.

Configuration Flow

Step 1: Select AI Provider OpenClaw will ask: Which AI service do you want to use?

  • 1. Use existing OpenClaw configuration (auto-detected)
  • 1. OpenAI
  • 1. Zhipu GLM
  • 1. DeepSeek
  • 1. Moonshot/Kimi
  • 1. Custom

Step 2: Enter API Key Based on your selection, OpenClaw will prompt for the API Key.

Get it from:

Step 3: Select Whisper Model For audio transcription on videos without subtitles:

  • tiny - Fastest, quick preview
  • base - Balanced, daily use (recommended)
  • small - Higher accuracy
  • medium - High precision
  • large - Highest precision

Step 4: Configure Cookies (Optional) Xiaohongshu and Douyin may need cookies to download videos. You can skip and configure later.

Manual Trigger

If configuration is incomplete, say:

"help me configure video-summary"

Or run:

~/.openclaw/workspace/skills/video-summary/scripts/setup.sh

Configuration Files

  • Config file: ~/.config/video-summary/config.sh
  • State file: ~/.config/video-summary/setup-state.json

Check Configuration Status

~/.openclaw/workspace/skills/video-summary/scripts/config-status.sh

Conversational Setup Guide

Setup Guide (for assistant): Help user configure step by step.

Trigger Conditions

Start conversational setup when:

  • User says "help me configure video-summary"
  • User says "configure video-summary"
  • Or on first use after skill installation

Configuration Steps

Step 1: Check Configuration Status

~/.openclaw/workspace/skills/video-summary/scripts/config-status.sh

If returns status: "complete", configuration is done. If returns status: "pending" or status: "not_started", start conversational setup.

Step 2: Select AI Provider

First, check if OpenClaw has existing LLM config:

# Detect OpenClaw's existing LLM configuration
cat ~/.openclaw/agents/main/agent/models.json 2>/dev/null | jq -r '.providers | to_entries[0] | "\(.key) \(.value.apiKey // .value.key)"' 2>/dev/null

OpenClaw should ask:

🎬 video-summary needs an AI service to generate summaries. Which one do you want to use? 1. Use existing OpenClaw configuration (detected: {provider}) 2. OpenAI 3. Zhipu GLM 4. DeepSeek 5. Moonshot/Kimi 6. Custom endpoint Reply with number or name.

Process user answer:

# If user selects option 1 (use existing OpenClaw config):
~/.openclaw/workspace/skills/video-summary/scripts/config-update.sh use_openclaw_config "true"

# Otherwise:
~/.openclaw/workspace/skills/video-summary/scripts/config-update.sh api_provider "openai"
# or "zhipu" / "deepseek" / "moonshot" / custom URL

Step 3: Enter API Key

OpenClaw should ask:

🔑 Please enter your API Key. Get it from: - OpenAI: https://platform.openai.com/api-keys - Zhipu: https://open.bigmodel.cn/ - DeepSeek: https://platform.deepseek.com/ - Moonshot: https://platform.moonshot.cn/

Process user answer:

~/.openclaw/workspace/skills/video-summary/scripts/config-update.sh api_key "sk-xxx..."

Step 4: Select Whisper Model

OpenClaw should ask:

🎤 Videos without subtitles need Whisper for transcription. Select model: 1. tiny - Fastest (quick preview) 2. base - Balanced (recommended) 3. small - Higher accuracy 4. medium - High precision 5. large - Highest precision Reply with number. Default is base.

Process user answer:

~/.openclaw/workspace/skills/video-summary/scripts/config-update.sh whisper_model "base"

Step 5: Configure Cookies (Optional)

OpenClaw should ask:

🍪 Xiaohongshu and Douyin may need cookies to download videos. Configure now? - Reply "skip" to skip for now - Reply "configure" to set up

If user says skip:

~/.openclaw/workspace/skills/video-summary/scripts/config-update.sh cookies_skip "true"

If user wants to configure:

Ask for each platform's cookies (Xiaohongshu, Douyin, Bilibili), then save:

~/.openclaw/workspace/skills/video-summary/scripts/config-update.sh cookies '{"xiaohongshu": "...", "douyin": "..."}'

Step 6: Configuration Complete

When all steps are done, OpenClaw should say:

✅ video-summary is now configured! You can use it now: - "Summarize this video: [URL]" - "Analyze this Bilibili video: [URL]"

Auto-detect Existing OpenClaw Configuration

If user has already configured an API in OpenClaw (e.g., Zhipu), auto-detect and use it:

# Detect OpenClaw configuration
cat ~/.openclaw/agents/main/agent/models.json | jq '.providers | to_entries[0]'

If detected, ask user:

Detected existing OpenClaw configuration for Zhipu API. Use this? (confirm/no)

If user confirms, use detected config to complete setup.


Quick Start

Check Dependencies

# Check all required tools
yt-dlp --version && jq --version && ffmpeg -version

# If missing, install
pip install yt-dlp
apt install jq ffmpeg  # or: brew install jq ffmpeg

Basic Usage

# Standard summary
video-summary "https://www.bilibili.com/video/BV1xx411c7mu"

# With chapter segmentation
video-summary "https://www.youtube.com/watch?v=xxxxx" --chapter

# JSON output for programmatic use
video-summary "https://www.xiaohongshu.com/explore/xxxxx" --json

# Subtitle only (no AI summary)
video-summary "https://v.douyin.com/xxxxx" --subtitle

# Save to file
video-summary "https://www.bilibili.com/video/BV1xx" --output summary.md

# Use cookies for restricted content
video-summary "https://www.xiaohongshu.com/explore/xxxxx" --cookies cookies.txt

In OpenClaw Agent

Just say:

"Summarize this video: [URL]"

The agent will automatically:

  1. Detect the platform
  2. Extract video content
  3. Generate a structured summary

Commands Reference

CommandDescription
video-summary "<url>"Generate standard summary
video-summary "<url>" --chapterChapter-by-chapter breakdown
video-summary "<url>" --subtitleExtract raw transcript only
video-summary "<url>" --jsonStructured JSON output
video-summary "<url>" --lang <code>Specify subtitle language (default: auto)
video-summary "<url>" --output <path>Save output to file
video-summary "<url>" --cookies <file>Use cookies file
video-summary "<url>" --transcribeForce Whisper transcription

How It Works

Platform Support Matrix

PlatformSubtitle ExtractionNotes
YouTubeNative CC + auto-generatedBest support
BilibiliNative CC + backup methodsRequires video ID extraction
XiaohongshuLimited (OCR fallback)No native subtitles, uses transcription
DouyinLimited (OCR fallback)Short-form video, may need transcription
Local filesWhisper transcriptionSupports mp4, mkv, webm, mp3, etc.

Supported URL Formats

YouTube:

  • https://www.youtube.com/watch?v=xxxxx
  • https://youtu.be/xxxxx

Bilibili:

  • https://www.bilibili.com/video/BV1xx411c7mu
  • https://www.bilibili.com/video/av123456

Xiaohongshu:

  • https://www.xiaohongshu.com/explore/xxxxx
  • https://xhslink.com/xxxxx (short link)

Douyin:

  • https://www.douyin.com/video/xxxxx
  • https://v.douyin.com/xxxxx (short link)

Processing Pipeline

URL Input
    ↓
Platform Detection
    ↓
Subtitle Extraction (yt-dlp / Whisper)
    ↓
Content Chunking (if long)
    ↓
LLM Summarization (OpenAI API / Agent)
    ↓
Structured Output
    ↓
Auto Cleanup

Performance Estimation

Whisper Transcription Time

Video Durationtinybasesmallmedium
5 min~30s~1m~2m~4m
15 min~1.5m~3m~6m~12m
30 min~3m~6m~15m~30m
60 min~6m~12m~30m~60m

Notes:

  • GPU significantly faster (3-10x)
  • base model recommended for balance
  • First run downloads model (~150MB for base)

Subtitle Extraction Time

PlatformTimeNotes
YouTube~5sDirect subtitle download
Bilibili~5sDirect subtitle download
Xiaohongshu~3mRequires transcription
Douyin~2mRequires transcription

Advanced Configuration

Whisper for Transcription

For platforms without native subtitles (Xiaohongshu, Douyin), install Whisper:

pip install openai-whisper

Then configure:

export VIDEO_SUMMARY_WHISPER_MODEL=base  # tiny, base, small, medium, large

OpenAI API for Summarization

For direct LLM-powered summaries, configure OpenAI API:

# Required for direct summarization
export OPENAI_API_KEY=sk-xxx

# Optional: Custom API endpoint
export OPENAI_BASE_URL=https://api.openai.com/v1

# Optional: Model selection
export OPENAI_MODEL=gpt-4o-mini

Without API key: Script outputs structured request for agent to process.

Cookie Configuration for Restricted Content

Some platforms require authentication for certain content:

# Method 1: Command line
video-summary "https://www.xiaohongshu.com/explore/xxxxx" --cookies cookies.txt

# Method 2: Environment variable
export VIDEO_SUMMARY_COOKIES=/path/to/cookies.txt

How to get cookies:

  1. Install browser extension: "Get cookies.txt LOCALLY"
  2. Login to the platform
  3. Export cookies to file

Custom Summary Prompt

Create ~/.video-summary/prompt.txt:

# Summary Template

## Key Insights
- List 3-5 core arguments

## Key Information
- Data, cases, quotes

## Action Items
- Specific actions viewers can take

## Timestamp Navigation
- Key moments with timestamps and descriptions

Output Formats

Standard Output (default)

# Video Title

**Duration**: 12:34
**Platform**: Bilibili
**Author**: Tech Creator

## Core Content
This video explains...

## Key Points
1. Point one
2. Point two
3. Point three

## Timestamps
- 00:00 Introduction
- 02:15 Core concept
- 08:30 Case study
- 11:45 Summary

JSON Output (--json)

{
  "title": "Video Title",
  "platform": "bilibili",
  "duration": 754,
  "author": "Creator Name",
  "summary": "Core content summary...",
  "keyPoints": ["Point 1", "Point 2", "Point 3"],
  "chapters": [
    {"time": 0, "title": "Intro", "summary": "..."},
    {"time": 135, "title": "Core Concept", "summary": "..."}
  ],
  "transcript": "Full transcript text..."
}

Technical Details

Dependencies

ToolRequiredPurpose
yt-dlpYesVideo/subtitle downloader
jqYesJSON processing
ffmpegYesAudio/video processing
whisperOptionalLocal transcription

File Structure

~/.openclaw/workspace/skills/video-summary/
├── SKILL.md              # This file
├── scripts/
│   ├── video-summary.sh  # Main CLI script
│   ├── setup.sh          # Setup wizard
│   ├── config-status.sh  # Check config status
│   └── config-update.sh  # Update config
└── references/
    └── platform-support.md  # Detailed platform notes

Environment Variables

VariableDefaultDescription
OPENAI_API_KEYauto-detectOpenAI API key (auto-detects OpenClaw config)
OPENAI_BASE_URLauto-detectCustom API endpoint (auto-detects OpenClaw config)
OPENAI_MODELgpt-4o-miniModel for summarization
VIDEO_SUMMARY_WHISPER_MODELbaseWhisper model size
VIDEO_SUMMARY_COOKIES-Path to cookies file

API Configuration Priority:

  1. Environment variables OPENAI_API_KEY / OPENAI_BASE_URL
  2. OpenClaw config file ~/.openclaw/agents/main/agent/models.json
  3. Manual configuration (setup.sh or config.sh)

Troubleshooting

"No subtitles found"

  • The video may not have subtitles/CC
  • Try --transcribe to use Whisper
  • For Xiaohongshu/Douyin, transcription is required

"yt-dlp: command not found"

pip install yt-dlp
# or
brew install yt-dlp

"Missing required dependencies"

# Install all dependencies
pip install yt-dlp
apt install jq ffmpeg  # Ubuntu/Debian
# or
brew install jq ffmpeg  # macOS

"Video too long"

Long videos (>1h) are automatically chunked:

  • Split into 10-minute segments
  • Summarize each segment
  • Merge into final summary

"Failed to fetch video info"

  • Video may be private or deleted
  • Try --cookies for restricted content
  • Region-locked videos may not work

"Rate limited"

  • Too many requests to platform
  • Wait a few minutes
  • Use --cookies for authenticated access

Comparison

FeatureOpenClaw summarizevideo-summary
YouTube
Bilibili
Xiaohongshu⚠️ (transcription)
Douyin⚠️ (transcription)
Chapter segmentation
Timestamps
Transcript extraction
JSON output
Save to file
Cookie support

References


Contributing

Found a bug or want to add platform support?

  • Open an issue on ClawHub
  • Submit a PR with your improvements

Changelog

v1.3.6 (2026-03-10)

  • Security: Moved prompts to external files to avoid ClawHub false positive
  • Prompts now loaded from prompts/summary-chapter.txt and prompts/summary-default.txt
  • No functional changes, same output quality

v1.3.5 (2026-03-09)

  • Security audit: removed patterns that triggered false positive flags
  • Neutralized prompt-like text in documentation and scripts
  • All functionality preserved, safer for public registry

v1.3.0 (2026-03-08)

  • Conversational setup: OpenClaw guides user through configuration after installation
  • Added config-status.sh to query configuration status
  • Added config-update.sh to handle configuration updates
  • setup.sh is now non-interactive, creates config state then hands off to OpenClaw
  • SKILL.md includes detailed conversational setup guide

v1.2.2 (2026-03-08)

  • Redesigned setup wizard with question-driven flow
  • Simplified English-only interface
  • Clearer step-by-step guidance

v1.2.1 (2026-03-08)

  • Auto-detect OpenClaw API config
  • Setup wizard uses detected config by default
  • Simplified setup flow

v1.2.0 (2026-03-08)

  • Added interactive setup wizard
  • Added detailed configuration guide
  • Added API key acquisition guide
  • Added cookie extraction guide
  • Added Whisper model selection guide

v1.1.0 (2026-03-08)

  • Added direct LLM integration
  • Added --output parameter
  • Added --cookies parameter
  • Added automatic temp file cleanup
  • Added progress estimation
  • Added dependency checking
  • Added URL format documentation
  • Added performance estimation table
  • Fixed metadata dependencies

v1.0.0

  • Initial release

*Make video content accessible. Watch less, learn more.*

适合场景

01

用户想查找某类 Agent Skill 时

02

需要根据任务场景推荐可安装能力包时

03

需要对比不同来源的安装命令和来源信息时

能力概览

能力 1

按任务关键词查找相关 Skills

能力 2

展示可复制的安装命令

能力 3

保留来源站点、仓库和原始说明,方便继续核验

安装后应在对应宿主中按原始 README 的触发条件使用;具体调用方式请以来源页面和 README 为准。

平台分布

Local Agent

85.8%
按下载量换算142

安全审计

暂无安全审计结果可展示。

权限和风险

敏感数据

该 Skill 可能接触密钥、Token、环境变量或敏感配置,应进入高风险复核队列,默认不自动发布。

安装前确认

本站仅展示第三方公开信息,不托管安装包,不提供自动安装或运行环境。安装前应自行审查源码、依赖和命令行为。当前只有一个来源,正式发布前建议补源仓库或其他目录站核验。

来源信息

继续浏览同类 Skills