Token导航 LogoToken导航TokenDH.com
开发权限需确认github未标认证来源可访问许可证需确认审计提醒

videocut-clip-oral视频剪辑口头

Agent Skill

用于辅助视频生成、动画合成、脚本化剪辑或 Remotion 等视频项目开发。它适合让 Agent 组织镜头、生成素材说明、维护合成代码或排查渲染问题。使用时需要确认分辨率、时长、素材路径和导出格式;涉及外部素材、人物肖像或商业发布时,应先核对版权授权和内容审核要求。

总安装

1,234

周安装

53

GitHub Stars

190

下载量

432
CodexClaudeCursorGemini CLI

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

GitHub

来源数

2

许可证

unknown

最后核验

2026-05-01

来源状态

来源可访问

安装方式

通过对话安装

复制提示词发给支持本地命令或 Skills 的 AI 助手,先确认命令和权限,再让它执行。

请帮我安装这个 Agent Skill:videocut-clip-oral(视频剪辑口头)
来源仓库:https://github.com/zrt-ai-lab/opencode-skills
仓库路径:skills/videocut-clip-oral
安装命令:
npx skills add https://github.com/zrt-ai-lab/opencode-skills --skill videocut-clip-oral
安装前请先检查当前环境是否支持对应 CLI,并向我确认将要执行的命令、安装目录、联网范围和文件读写权限;确认后再执行。

命令行安装

复制命令到本机终端执行。该命令会通过 npx skills 从第三方来源获取 Skill;本站只展示命令,不托管安装包,也不自动执行。

skills.shnpx skills
npx skills add https://github.com/zrt-ai-lab/opencode-skills --skill videocut-clip-oral

简介

用于视频剪辑中的口头表达或语音相关功能支持。videocut-clip-oral 属于开发类 Skill,可作为该场景下的辅助能力补充。

  • 适合辅助视频生成、动画合成或 Remotion 项目开发。
  • 使用时需确认分辨率、时长、素材路径和导出格式。
  • 涉及外部素材或商业发布时应核对版权授权和内容审核要求。
  • 安装方式:通过 GitHub 仓库添加,支持 Codex、Claude 等宿主环境。

SKILL.md

剪口播

转录 + 口误/静音识别 → 生成审查稿

快速使用

用户: 帮我剪这个口播视频
用户: 处理一下这个视频

流程

1. FunASR 30s 分段转录(字符级时间戳)
    ↓
2. 识别口误(逐句检查)
    ↓
3. 识别微口误(VAD 检测短片段)
    ↓
4. 识别语气词(嗯/哎/诶 等)
    ↓
5. 识别静音(≥1s)
    ↓
6. 生成审查稿(时间戳驱动)
    ↓
7. 输出删除任务 TodoList
    ↓
【等待用户确认】→ 用户确认后,执行 /videocut:剪辑

⚠️ 为什么用 30s 分段

FunASR 长视频有时间戳漂移,30s 分段可避免。

进度 TodoList

启动时创建:

- [ ] 读取「转录最佳实践」→ 转录视频
- [ ] 读取「口误识别方法论」→ 识别口误
- [ ] VAD 检测微口误(短片段 < 0.5s)
- [ ] 扫描语气词(嗯/哎/诶 等)
- [ ] 识别静音(≥1s)
- [ ] 生成审查稿
- [ ] 输出删除任务清单

⚠️ 必须先读方法论再执行

阶段先读再执行
转录tips/转录最佳实践.md调用ASR
识别口误tips/口误识别方法论.md逐句分析

核心:时间戳驱动

删除任务格式

每项必须标注精确时间戳 (start-end)

口误(N处):
- [ ] 1. `(start-end)` 删"错误文本" → 保留"正确文本"

语气词(N处):
- [ ] 1. `(前字end-后字start)` 删"嗯" 上下文: XX【嗯】YY

静音(N处):
- [ ] 1. `(start-end)` 静音Xs

口误类型

类型示例删除策略
重复型拉满新拉满只删差异("新")
替换型AI就是AI就会删第一个完整版本("AI就是")
卡顿型听会会删第一个重复字

⚠️ 关键规则

  1. 时间戳驱动:审查稿直接标注时间戳,剪辑不再搜索文本
  2. 逐token分析:对于"删前面保后面"的口误,必须逐token查时间戳
  3. 检查时间跨度:如果口误时间跨度 > 2秒,必有静音,需拆分

输出文件

01-xxx-v1_transcript.json  # 转录结果(含时间戳)
01-xxx-v1_审查稿.md        # 口误审查稿

展示要求

生成审查稿后,必须展示给用户

  1. 写入文件 01-xxx-v1_审查稿.md
  2. 读取并展示内容
  3. 等待用户确认要删除哪些项目

方法论

详见 tips/口误识别方法论.md

  • 口误识别方法(逐句检查)
  • "删前面保后面"的精确处理
  • FunASR 时间戳对齐规则

适合场景

01

用户想查找某类 Agent Skill 时

02

需要根据任务场景推荐可安装能力包时

03

需要对比不同来源的安装命令和来源信息时

能力概览

能力 1

按任务关键词查找相关 Skills

能力 2

展示可复制的安装命令

能力 3

保留来源站点、仓库和原始说明,方便继续核验

能力 4

展示第三方安全扫描或审计结果

安装后应在对应宿主中按原始 README 的触发条件使用;具体调用方式请以来源页面和 README 为准。

平台分布

Codex

34.45%
按下载量换算149

Claude

29.87%
按下载量换算129

Cursor

19.07%
按下载量换算82

Gemini CLI

9.72%
按下载量换算42

安全审计

Gen Agent Trust Hub

可疑

Socket

通过

Snyk

通过

权限和风险

权限需确认

当前来源未能明确判断权限范围,默认进入异常复核队列。

安装前确认

本站仅展示第三方公开信息,不托管安装包,不提供自动安装或运行环境。安装前应自行审查源码、依赖和命令行为。来源安全扫描存在 warning/failed 结果,不能写成本站确认安全。当前只有一个来源,正式发布前建议补源仓库或其他目录站核验。

来源信息

继续浏览同类 Skills