Token导航 LogoToken导航TokenDH.com
效率需要联网clawhub未标认证来源可访问clear审计提醒

xia-zhuan-audio夏传音频

Agent Skill

用于辅助音频、音乐、语音转写、语音合成或声音素材处理。它适合让 Agent 生成配乐说明、整理音频流程、调用语音工具或处理播客和视频配音素材。使用时需要确认输入音频来源、输出格式、时长和模型限制;涉及人声克隆、版权音乐或公开发布时,应先核对授权和合规边界。

总安装

3,481

周安装

148

GitHub Stars

1

下载量

1,220
OpenClaw

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

GitHub

来源数

2

许可证

MIT-0

最后核验

2026-05-01

来源状态

来源可访问

安装方式

通过对话安装

复制提示词发给支持本地命令或 Skills 的 AI 助手,先确认命令和权限,再让它执行。

请帮我安装这个 Agent Skill:xia-zhuan-audio(夏传音频)
来源仓库:https://github.com/luis1213899/xia-zhuan-audio
安装命令:
openclaw skills install xia-zhuan-audio
安装前请先检查当前环境是否支持对应 CLI,并向我确认将要执行的命令、安装目录、联网范围和文件读写权限;确认后再执行。

命令行安装

复制命令到本机终端执行。该命令会通过 OpenClaw 从第三方来源获取 Skill;本站只展示命令,不托管安装包,也不自动执行。

ClawHubOpenClaw
openclaw skills install xia-zhuan-audio

简介

🎵 音视频格式转换与处理工具箱。基于 FFmpeg + Whisper AI,支持:格式转换、视频提取音频、合并、分割、压缩、查看信息、音频转文字。

SKILL.md

name
xia-zhuan-audio
description
🎵 音视频格式转换与处理工具箱。基于 FFmpeg + Whisper AI,支持:格式转换、视频提取音频、合并、分割、压缩、查看信息、音频转文字。
license
MIT
metadata
homepage
https://github.com/luis12123899/xia-zhuan-audio
emoji
🎵
requires
bins
env

虾转音频 (xia-zhuan-audio)

功能列表

#功能说明
1格式转换m4a→mp3, wav→flac, ape→flac, aac→mp3 等,支持 20+ 格式
2视频提取音频mp4/mkv/avi/flv → mp3/aac/wav 等
3合并音频将多个音频拼接成一个文件
4分割音频按时间范围截取片段
5压缩音频减小文件体积(64k/128k/192k)
6查看音频信息时长 / 码率 / 采样率 / 声道 / 元数据
7音频转文字Whisper AI 自动转录,支持 txt / srt / vtt / json

支持的格式

音频格式: mp3, wav, flac, aac, m4a, ogg, wma, aiff, opus, ape, alac 视频格式: mp4, mkv, avi, mov, flv, wmv, webm

环境变量配置

变量说明默认值
XZA_FFMPEGFFmpeg/FFprobe 路径系统 PATH 中查找
XZA_FFPROBEFFprobe 路径从 XZA_FFMPEG 推断
XZA_SCRIPTDIR脚本目录自动检测
XZA_MODELDIRWhisper 模型保存目录技能目录下的 whisper_models
HF_ENDPOINTHuggingFace 模型下载源https://huggingface.co(官方)

依赖

  • FFmpeg — 系统已有或从 https://ffmpeg.org 下载,并在 PATH 中可用
  • Python — 系统已有(用于音频转文字)
  • faster-whisper — 运行 pip install faster-whisper 安装

Whisper 模型安全说明

模型通过 HuggingFace 官方源下载(默认),如需使用国内镜像:

set HF_ENDPOINT=https://hf-mirror.com

使用方式

通过 OpenClaw 对话触发(推荐)

直接用自然语言描述需求,例如:

  • "把这段 m4a 转成 mp3"
  • "把这个视频的音频提取出来"
  • "把这几个音频合并成一个"
  • "把这段音频 1:30 到 2:45 的部分截出来"
  • "压缩这个音频,128kbps"
  • "查看这个音频的信息"
  • "把这段录音转成文字"

通过命令行直接调用

# 格式转换
node audio-forge.js convert <输入> <输出格式> [--bitrate 192k]

# 视频提取音频
node audio-forge.js extract <视频> [输出格式] [--bitrate 192k]

# 合并音频
node audio-forge.js merge <文件1> <文件2> [...] <输出>

# 分割音频
node audio-forge.js split <输入> <开始时间> <结束时间>

# 压缩音频
node audio-forge.js compress <输入> [--quality low|medium|high]

# 查看音频信息
node audio-forge.js info <音频文件>

# 音频转文字(Whisper)
python transcribe.py <音频/视频文件> [--model small] [--language zh] [--format txt] [--device auto]

音频转文字 - Whisper 模型

模型精度速度首次下载
tiny较低最快~75MB
base标准~150MB
small良好较快~460MB
medium很好较慢~1.5GB
large最高最慢~3GB

安装

openclaw skill install xia-zhuan-audio

或直接把 xia-zhuan-audio 文件夹放入 ~/.openclaw/workspace/skills/ 目录。


创建:2026-04-11 | 作者:@luis12123899

适合场景

01

OpenClaw 用户查找和安装 Skill 时

02

用户想查找某类 Agent Skill 时

03

需要根据任务场景推荐可安装能力包时

04

需要对比不同来源的安装命令和来源信息时

能力概览

能力 1

按任务关键词查找相关 Skills

能力 2

展示可复制的安装命令

能力 3

保留来源站点、仓库和原始说明,方便继续核验

能力 4

补充不同宿主或平台的使用分布数据

能力 5

展示第三方安全扫描或审计结果

安装后应在对应宿主中按原始 README 的触发条件使用;具体调用方式请以来源页面和 README 为准。

平台分布

OpenClaw

92.16%
按下载量换算1,124

安全审计

VirusTotal

未展示

ClawScan

通过

Static analysis

可疑

权限和风险

需要联网

该 Skill 可能需要联网访问来源站点、仓库或外部 API;具体网络访问范围需要结合源码和 README 复核。

安装前确认

本站仅展示第三方公开信息,不托管安装包,不提供自动安装或运行环境。安装前应自行审查源码、依赖和命令行为。来源安全扫描存在 warning/failed 结果,不能写成本站确认安全。当前只有一个来源,正式发布前建议补源仓库或其他目录站核验。

来源信息

继续浏览同类 Skills