Token导航 LogoToken导航TokenDH.com
效率操作浏览器clawhub未标认证来源可访问clear审计通过

video-batch-transcript视频批量转录

Agent Skill

用于辅助视频生成、动画合成、脚本化剪辑或 Remotion 等视频项目开发。它适合让 Agent 组织镜头、生成素材说明、维护合成代码或排查渲染问题。使用时需要确认分辨率、时长、素材路径和导出格式;涉及外部素材、人物肖像或商业发布时,应先核对版权授权和内容审核要求。

总安装

2,804

周安装

118

GitHub Stars

1

下载量

982
OpenClaw

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

GitHub

来源数

2

许可证

MIT-0

最后核验

2026-05-01

来源状态

来源可访问

安装方式

通过对话安装

复制提示词发给支持本地命令或 Skills 的 AI 助手,先确认命令和权限,再让它执行。

请帮我安装这个 Agent Skill:video-batch-transcript(视频批量转录)
来源仓库:https://github.com/shenghoo123-png/video-batch-transcript
安装命令:
openclaw skills install video-batch-transcript
安装前请先检查当前环境是否支持对应 CLI,并向我确认将要执行的命令、安装目录、联网范围和文件读写权限;确认后再执行。

命令行安装

复制命令到本机终端执行。该命令会通过 OpenClaw 从第三方来源获取 Skill;本站只展示命令,不托管安装包,也不自动执行。

ClawHubOpenClaw
openclaw skills install video-batch-transcript

简介

通用视频批量转录工具 - 支持 1000+ 网站(B 站、YouTube、抖音、Twitch 等),使用 yt-dlp 批量下载视频音频,GPU 加速语音转文字(faster-whisper + CUDA),自动校正专业术语,生成结构化学习笔记。支持断点续传、批量导出、多格式输出、需要登录的网站配置。

SKILL.md

name
video-batch-transcript
description
通用视频批量转录工具 - 支持 1000+ 网站(B 站、YouTube、抖音、Twitch 等),使用 yt-dlp 批量下载视频音频,GPU 加速语音转文字(faster-whisper + CUDA),自动校正专业术语,生成结构化学习笔记。支持断点续传、批量导出、多格式输出、需要登录的网站配置。

Video Batch Transcript

通用视频批量转录工具 - 支持 1000+ 网站

核心功能

  • 🌐 全网支持 - 基于 yt-dlp,支持 1000+ 网站(B 站、YouTube、抖音、Twitch 等)
  • 📥 批量下载 - 支持单视频、合集、播放列表、频道
  • 🚀 GPU 加速转录 - faster-whisper + CUDA,比 OpenAI Whisper 快 4-6 倍
  • 📝 结构化笔记 - 自动生成单集笔记 + 完整汇总
  • 🔧 术语校正 - 自动识别和校正专业术语
  • 💾 断点续传 - 支持中断后继续处理
  • 📤 多格式导出 - txt/md/docx,可选写入飞书文档
  • 🔐 登录支持 - 支持需要登录的网站(cookies 配置)

支持的网站

🇨🇳 国内平台

平台支持类型需要登录
哔哩哔哩 (Bilibili)视频、合集、频道部分
抖音 (Douyin)视频、合集部分
快手 (Kuaishou)视频部分
西瓜视频视频、合集部分
腾讯视频视频、剧集部分
爱奇艺视频、剧集部分
优酷视频、剧集部分
微博视频视频
小红书视频部分

🌍 国际平台

平台支持类型需要登录
YouTube视频、播放列表、频道部分
Vimeo视频、合集部分
Dailymotion视频、播放列表部分
Twitch视频、频道部分
Twitter/X视频
Instagram视频、Reels部分
TikTok视频部分
Facebook视频部分

📺 流媒体 (需登录)

  • Netflix、Hulu、HBO、Disney+、Amazon Prime

🎵 音频平台

  • SoundCloud、Bandcamp、Spotify、Apple Music

📚 教育平台

  • Coursera、edX、Udemy、Khan Academy、TED

完整支持列表: https://github.com/yt-dlp/yt-dlp/blob/master/supportedsites.md

快速开始

1. 安装依赖

cd /root/.openclaw/workspace/skills/video-batch-transcript
pip install -r requirements.txt

2. 检查环境

python scripts/check_env.py

3. 基本使用

# YouTube 视频
python scripts/batch_transcript.py \
  --url "https://www.youtube.com/watch?v=xxx" \
  --output-dir "~/video-notes"

# B 站合集
python scripts/batch_transcript.py \
  --url "https://space.bilibili.com/xxx/channel/collectiondetail?sid=xxx" \
  --output-dir "~/video-notes"

# YouTube 播放列表
python scripts/batch_transcript.py \
  --url "https://www.youtube.com/playlist?list=xxx" \
  --output-dir "~/video-notes"

高级功能

1. 使用 Cookies(需要登录的网站)

# 从浏览器获取 cookies(推荐)
python scripts/batch_transcript.py \
  --url "https://www.youtube.com/watch?v=xxx" \
  --cookies-from-browser chrome

# 支持浏览器:chrome, firefox, safari, edge, brave, opera

# 或使用 cookies 文件
python scripts/batch_transcript.py \
  --url "https://www.netflix.com/title/xxx" \
  --cookies "cookies/netflix.txt"

2. 指定视频质量

# 下载最佳质量
python scripts/batch_transcript.py \
  --url "xxx" \
  --format "best"

# 下载 1080p
python scripts/batch_transcript.py \
  --url "xxx" \
  --format "bestvideo[height<=1080]+bestaudio/best[height<=1080]"

# 仅音频
python scripts/batch_transcript.py \
  --url "xxx" \
  --format "bestaudio"

3. 并行处理

# 使用 4 个进程并行处理
python scripts/batch_transcript.py \
  --url "xxx" \
  --workers 4

4. 断点续传

# 自动续传(默认)
python scripts/batch_transcript.py --url "xxx"

# 强制重新处理
python scripts/batch_transcript.py --url "xxx" --no-resume

配置选项

命令行参数

参数说明默认值
--url视频/合集 URL必填
--output-dir输出目录~/video-notes
--episodes指定集数 (e.g., "1-5,8,10")全部
--modelWhisper 模型 (tiny/base/small/medium/large)small
--device设备 (auto/cuda/cpu)auto
--language语言代码 (zh/en/ja 等)auto
--format视频格式选择bestaudio
--cookies-from-browser浏览器 cookies
--cookiescookies 文件路径
--terminology术语表 JSON 文件路径内置
--workers并行处理数1
--no-resume禁用断点续传
--check-env仅检查环境

配置文件

创建 config/config.yaml

# 默认输出目录
output_dir: ~/video-notes

# Whisper 模型设置
whisper:
  model: small
  device: auto  # auto/cuda/cpu
  language: auto  # auto/zh/en/ja 等
  compute_type: float16

# 下载设置
download:
  format: bestaudio  # 默认下载格式
  audio_format: mp3  # 音频输出格式
  audio_quality: 192  # 音频质量 (kbps)
  
  # Cookies 配置(可选)
  cookies:
    enabled: false
    browser: chrome  # chrome/firefox/safari/edge
    file: ""  # 或使用 cookies 文件路径

# 输出格式
export:
  formats: [md, txt]  # md/txt/docx
  include_timestamps: false
  include_summary: true

# 术语校正
terminology:
  enabled: true
  custom_file: ""

# 并行处理
parallel:
  workers: 1
  max_memory_gb: 8

使用示例

示例 1: YouTube 教程系列

# 下载整个播放列表并转录
python scripts/batch_transcript.py \
  --url "https://www.youtube.com/playlist?list=PLxxx" \
  --output-dir "~/youtube-ml-course" \
  --device cuda \
  --model medium

示例 2: B 站 UP 主频道

# 下载 UP 主所有视频
python scripts/batch_transcript.py \
  --url "https://space.bilibili.com/123/channel/collectiondetail?sid=456" \
  --output-dir "~/bilibili-ai-series" \
  --episodes "1-20"

示例 3: 抖音合集

# 下载抖音合集(可能需要 cookies)
python scripts/batch_transcript.py \
  --url "https://www.douyin.com/collection/xxx" \
  --output-dir "~/douyin-notes" \
  --cookies-from-browser chrome

示例 4: Twitch 频道视频

# 下载 Twitch 频道视频
python scripts/batch_transcript.py \
  --url "https://www.twitch.tv/xxx/videos" \
  --output-dir "~/twitch-vods" \
  --language en

示例 5: 多平台混合处理

# 创建脚本处理多个平台的视频
cat > process_all.sh << 'EOF'
#!/bin/bash

# YouTube
python scripts/batch_transcript.py \
  --url "https://youtube.com/playlist?list=xxx" \
  --output-dir "~/notes/youtube"

# B 站
python scripts/batch_transcript.py \
  --url "https://space.bilibili.com/xxx/collectiondetail?sid=xxx" \
  --output-dir "~/notes/bilibili"

# Vimeo
python scripts/batch_transcript.py \
  --url "https://vimeo.com/album/xxx" \
  --output-dir "~/notes/vimeo"
EOF

chmod +x process_all.sh
./process_all.sh

输出结构

~/video-notes/
├── 合集或频道名称/
│   ├── 001_视频标题/
│   │   ├── audio.mp3          # 音频文件
│   │   ├── transcript.txt     # 原始转录
│   │   ├── notes.md          # 结构化笔记
│   │   └── metadata.json      # 元数据(含来源网站)
│   ├── 002_视频标题/
│   │   └── ...
│   ├── 合集汇总.md            # 完整汇总笔记
│   └── metadata.json          # 合集元数据

网站特定配置

YouTube

# 推荐:使用 cookies 避免 403 错误
python scripts/batch_transcript.py \
  --url "https://youtube.com/watch?v=xxx" \
  --cookies-from-browser chrome

# 下载字幕(如果有)
python scripts/batch_transcript.py \
  --url "https://youtube.com/watch?v=xxx" \
  --write-subs \
  --sub-langs zh-Hans,en

B 站 (Bilibili)

# 普通视频(无需登录)
python scripts/batch_transcript.py \
  --url "https://www.bilibili.com/video/BVxxx"

# 需要登录的合集
python scripts/batch_transcript.py \
  --url "https://space.bilibili.com/xxx/collectiondetail?sid=xxx" \
  --cookies-from-browser chrome

抖音/TikTok

# 可能需要 cookies
python scripts/batch_transcript.py \
  --url "https://www.douyin.com/video/xxx" \
  --cookies-from-browser chrome

Netflix/流媒体

# 需要 cookies 文件
# 1. 使用浏览器扩展导出 cookies
# 2. 保存为 netscape 格式
python scripts/batch_transcript.py \
  --url "https://www.netflix.com/title/xxx" \
  --cookies "cookies/netflix.txt"

模型选择建议

模型显存需求转录速度准确率适用场景
tiny~1 GB最快一般快速测试、低配设备
base~1 GB较好日常使用
small~2 GB中等推荐默认
medium~5 GB较慢很好高质量需求
large~10 GB最慢最佳专业场景

故障排除

常见问题

问题原因解决方案
HTTP 403网站阻止请求使用 --cookies-from-browser
需要登录内容需认证配置 cookies
下载慢网络问题使用代理或 CDN
转录错误音频损坏重新下载音频
内存不足模型太大使用更小模型或减少 workers

获取 Cookies

方法 1: 从浏览器自动获取(推荐)

python scripts/batch_transcript.py \
  --url "xxx" \
  --cookies-from-browser chrome

方法 2: 导出 cookies 文件

  1. 安装浏览器扩展(如 "Get cookies.txt")
  2. 登录目标网站
  3. 导出 cookies 为 Netscape 格式
  4. 使用 --cookies "path/to/cookies.txt"

GPU 加速检查

# 检查 CUDA
python -c "import torch; print(f'CUDA: {torch.cuda.is_available()}')"

# 查看 GPU
nvidia-smi

更新日志

v1.0.0 (2026-03-05)

  • 初始版本
  • 支持 1000+ yt-dlp 兼容网站
  • GPU 加速转录 (faster-whisper)
  • 结构化笔记生成
  • 断点续传
  • 多格式导出
  • Cookies 登录支持

许可证

MIT License

适合场景

01

OpenClaw 用户查找和安装 Skill 时

02

用户想查找某类 Agent Skill 时

03

需要根据任务场景推荐可安装能力包时

04

需要对比不同来源的安装命令和来源信息时

能力概览

能力 1

按任务关键词查找相关 Skills

能力 2

展示可复制的安装命令

能力 3

保留来源站点、仓库和原始说明,方便继续核验

能力 4

补充不同宿主或平台的使用分布数据

能力 5

展示第三方安全扫描或审计结果

安装后应在对应宿主中按原始 README 的触发条件使用;具体调用方式请以来源页面和 README 为准。

平台分布

OpenClaw

92.95%
按下载量换算913

安全审计

VirusTotal

通过

ClawScan

通过

Static analysis

通过

权限和风险

操作浏览器

该 Skill 可能涉及浏览器控制能力,使用时可能读取或操作网页内容,需要在受控环境中确认权限边界。

安装前确认

本站仅展示第三方公开信息,不托管安装包,不提供自动安装或运行环境。安装前应自行审查源码、依赖和命令行为。当前只有一个来源,正式发布前建议补源仓库或其他目录站核验。

来源信息

继续浏览同类 Skills