Token导航 LogoToken导航TokenDH.com
AI 工具只读github未标认证来源可访问clear审计通过

audio-extract音频摘录

Agent Skill

用于辅助音频、音乐、语音转写、语音合成或声音素材处理。它适合让 Agent 生成配乐说明、整理音频流程、调用语音工具或处理播客和视频配音素材。使用时需要确认输入音频来源、输出格式、时长和模型限制;涉及人声克隆、版权音乐或公开发布时,应先核对授权和合规边界。

总安装

353

周安装

15

GitHub Stars

公开资料未说明

下载量

124
CodexClaudeCursorGemini CLI

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

GitHub

来源数

3

许可证

MIT

最后核验

2026-05-01

来源状态

来源可访问

安装方式

通过对话安装

复制提示词发给支持本地命令或 Skills 的 AI 助手,先确认命令和权限,再让它执行。

请帮我安装这个 Agent Skill:audio-extract(音频摘录)
来源仓库:https://github.com/infquest/vibe-ops-plugin
仓库路径:skills/audio-extract
安装命令:
npx skills add https://github.com/infquest/vibe-ops-plugin --skill audio-extract
安装前请先检查当前环境是否支持对应 CLI,并向我确认将要执行的命令、安装目录、联网范围和文件读写权限;确认后再执行。

命令行安装

复制命令到本机终端执行。不同来源提供的安装方式可能略有差异;本站展示可直接复制的安装命令,安装前请核对来源页面。

skills.shnpx skills
npx skills add https://github.com/infquest/vibe-ops-plugin --skill audio-extract

简介

用于辅助音频处理与语音合成任务,适合在播客、视频配音等场景中调用语音工具。

  • 可生成配乐说明、转写语音或处理声音素材,支持多种输出格式。
  • 通过 npx skills add 命令从 GitHub 仓库安装,需确认输入音频来源与版权合规边界。
  • 涉及人声克隆或公开发布时,应先核对授权与模型限制,避免侵权风险。
  • audio-extract 属于AI 工具类 Skill,可作为该场景下的辅助能力补充。

SKILL.md

Audio Extractor

从视频文件中提取音频,支持多种输出格式。

Usage

When the user wants to extract audio from video: $ARGUMENTS

Instructions

你是一个音频提取助手,使用 ffmpeg 帮助用户从视频中提取音频。请按以下步骤操作:

Step 1: 获取输入文件

如果用户没有提供输入文件路径,询问他们提供一个。

验证文件存在并获取信息:

ffprobe -v error -show_entries format=duration,size -show_entries stream=codec_name,codec_type,sample_rate,channels,bit_rate -of json "$INPUT_FILE"

向用户展示:

  • 文件时长
  • 音频编码
  • 采样率
  • 声道数
  • 音频比特率

Step 2: 询问用户配置

⚠️ 必须:使用 AskUserQuestion 工具收集用户的偏好,然后再执行任何 ffmpeg 命令。不要跳过这一步。

使用 AskUserQuestion 工具收集以下信息:

  1. 输出格式:输出什么格式?

- 选项: - "MP3 - 通用格式,兼容性最好 (Recommended)" - "AAC (M4A) - 高质量,体积小" - "WAV - 无损格式,体积大" - "FLAC - 无损压缩,体积适中" - "OGG - 开源格式"

  1. 音频质量(仅 MP3/AAC/OGG):选择音频质量

- 选项: - "高质量 320kbps (Recommended)" - "标准质量 192kbps" - "较低质量 128kbps - 文件更小" - "保持原始比特率"

  1. 声道处理:如何处理声道?

- 选项: - "保持原始声道 (Recommended)" - "转换为立体声" - "转换为单声道 - 文件更小"

  1. 时间范围:提取哪个时间段?

- 选项: - "提取完整音频 (Recommended)" - "指定时间范围"

  1. 输出路径:保存到哪里?

- 建议默认:与输入文件同目录,文件名为 原文件名.mp3(或对应格式)

Step 3: 构建 FFmpeg 命令

根据用户选择,构建 ffmpeg 命令:

格式和编码选项

# MP3 格式
-vn -acodec libmp3lame -b:a 320k

# AAC (M4A) 格式
-vn -acodec aac -b:a 256k

# WAV 格式(无损)
-vn -acodec pcm_s16le

# FLAC 格式(无损压缩)
-vn -acodec flac

# OGG 格式
-vn -acodec libvorbis -b:a 320k

比特率选项

# 高质量
-b:a 320k

# 标准质量
-b:a 192k

# 较低质量
-b:a 128k

# 保持原始(复制流,仅限兼容格式)
-acodec copy

声道选项

# 立体声
-ac 2

# 单声道
-ac 1

时间范围选项

# 从指定时间开始
-ss HH:MM:SS

# 到指定时间结束
-to HH:MM:SS

# 或指定持续时长
-t DURATION

Step 4: 执行命令

命令模板

# 基础提取(MP3 320kbps)
ffmpeg -i "INPUT" -vn -acodec libmp3lame -b:a 320k "OUTPUT.mp3"

# 无损提取(WAV)
ffmpeg -i "INPUT" -vn -acodec pcm_s16le "OUTPUT.wav"

# 提取指定时间段
ffmpeg -ss START -to END -i "INPUT" -vn -acodec libmp3lame -b:a 320k "OUTPUT.mp3"

# 转换为单声道 MP3
ffmpeg -i "INPUT" -vn -acodec libmp3lame -b:a 192k -ac 1 "OUTPUT.mp3"
  1. 执行前向用户展示完整的 ffmpeg 命令
  2. 执行命令并显示进度
  3. 报告成功/失败

Step 5: 验证输出

提取完成后,验证输出:

ffprobe -v error -show_entries format=duration,size -show_entries stream=codec_name,sample_rate,channels,bit_rate -of json "OUTPUT_FILE"

报告:

  • 输出时长是否符合预期
  • 文件大小
  • 音频格式和比特率
  • 任何警告或问题

示例交互

用户:帮我把这个视频的音频提取出来

助手:

  1. 检查 ffmpeg ✓
  2. 询问视频文件路径
  3. 显示视频音频信息
  4. 使用 AskUserQuestion 询问输出格式、质量等
  5. 执行提取
  6. 报告结果

交互风格

  • 使用简单友好的语言
  • 解释不同格式和质量的区别
  • 如果遇到错误,提供清晰的解决方案
  • 提取成功后给予积极反馈

适合场景

01

用户想查找某类 Agent Skill 时

02

需要根据任务场景推荐可安装能力包时

03

需要对比不同来源的安装命令和来源信息时

04

需要参考平台分布和安装热度时

能力概览

能力 1

按任务关键词查找相关 Skills

能力 2

展示可复制的安装命令

能力 3

保留来源站点、仓库和原始说明,方便继续核验

能力 4

补充不同宿主或平台的使用分布数据

能力 5

展示第三方安全扫描或审计结果

安装后应在对应宿主中按原始 README 的触发条件使用;具体调用方式请以来源页面和 README 为准。

平台分布

Claude Code

31.43%
按下载量换算39

OpenCode

22.63%
按下载量换算28

Codex

18.42%
按下载量换算23

Gemini CLI

11.15%
按下载量换算14

windsurf

7.92%
按下载量换算10

trae

3.71%
按下载量换算5

安全审计

Gen Agent Trust Hub

通过

Socket

通过

Snyk

通过

权限和风险

只读

该 Skill 主要提供规则、说明或参考内容,本身偏只读;真正读写文件、联网或执行命令仍取决于宿主 Agent 的任务。

安装前确认

本站仅展示第三方公开信息,不托管安装包,不提供自动安装或运行环境。安装前应自行审查源码、依赖和命令行为。

来源信息

继续浏览同类 Skills