Token导航 LogoToken导航TokenDH.com
效率权限需确认clawhub未标认证来源可访问clear审计提醒

audio-enhancement-engine音频增强引擎

Agent Skill

用于辅助音频、音乐、语音转写、语音合成或声音素材处理。它适合让 Agent 生成配乐说明、整理音频流程、调用语音工具或处理播客和视频配音素材。使用时需要确认输入音频来源、输出格式、时长和模型限制;涉及人声克隆、版权音乐或公开发布时,应先核对授权和合规边界。

总安装

4,608

周安装

192

GitHub Stars

公开资料未说明

下载量

1,536
OpenClaw

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

GitHub

来源数

2

许可证

MIT-0

最后核验

2026-05-01

来源状态

来源可访问

安装方式

通过对话安装

复制提示词发给支持本地命令或 Skills 的 AI 助手,先确认命令和权限,再让它执行。

请帮我安装这个 Agent Skill:audio-enhancement-engine(音频增强引擎)
来源仓库:https://github.com/wangminrui2022/audio-enhancement-engine
安装命令:
openclaw skills install audio-enhancement-engine
安装前请先检查当前环境是否支持对应 CLI,并向我确认将要执行的命令、安装目录、联网范围和文件读写权限;确认后再执行。

命令行安装

复制命令到本机终端执行。该命令会通过 OpenClaw 从第三方来源获取 Skill;本站只展示命令,不托管安装包,也不自动执行。

ClawHubOpenClaw
openclaw skills install audio-enhancement-engine

简介

集成VoiceFixer和AudioSR技术的专业音频修复工具集。

  • 可提升音质、降噪、修复录音并支持48kHz超分辨率处理。
  • 自动识别会议录音、音乐文件等不同类型进行针对性优化。
  • 批量处理时注意存储空间,建议先测试小样再处理完整文件。
  • audio-enhancement-engine 属于效率类 Skill,可作为该场景下的辅助能力补充。

SKILL.md

name
audio-enhancement-engine
description
|
metadata
openclaw
requires
bins
user-invocable
true

Audio Enhancement Skill

功能:本地音频增强与修复统一工具,集成 VoiceFixer(语音降噪/修复)和 AudioSR(高保真超级分辨率)。支持单文件与目录批量处理,自动适配最合适的增强模式,输出清晰、高质量的 48kHz WAV 文件。

触发时机(Triggers)

  • 用户提供音频文件(.wav、.mp3、.flac、.m4a、.ogg 等)或音频文件夹路径,并表达增强音质、修复、降噪、高保真等意图。
  • 用户说“音频增强”“修复录音”“降噪”“提升音质”“高保真”“48kHz”等关键词。
  • 支持单个文件处理或整个文件夹批量处理(支持递归子目录)。

支持的两种增强模式

  1. VoiceFixer 通用语音修复(默认模式)

- 擅长语音降噪、提升清晰度、修复轻微失真。 - 推荐用于:会议录音、访谈、播客、语音笔记、老旧录音。

  1. AudioSR 高保真音频超级分辨率(启用 --hifi 时)

- 将音频提升至 48kHz,显著增加高频细节和整体保真度。 - 推荐用于:音乐、演唱、人声、需要高音质的场景。

参数提取指南

当决定调用此技能时,请从用户消息中准确提取以下参数:

  1. <输入路径> (必填): 用户提供的音频文件路径或文件夹路径(支持相对/绝对路径)。
  2. <输出路径> (选填): 用户指定的输出文件或目录路径。若未指定,默认在输入同级目录自动添加 _enhanced 后缀。
  3. <模式选择> (选填):

- 默认使用 VoiceFixer。 - 若用户提到“高保真”“音乐”“48kHz”“超分辨率”等,自动添加 --hifi 并使用 AudioSR。

  1. VoiceFixer 专用参数(默认模式):

- --mode:0/1/2(推荐 1,默认 1) - --cuda:是否使用 GPU - -r, --recursive:是否递归子目录

  1. AudioSR 专用参数--hifi 模式):

- --model_namebasicspeech(人声推荐 speech) - --ddim_steps:扩散步数(默认 50,建议 50-100) - --guidance_scale:引导尺度(默认 3.5) - --seed:随机种子(默认 42) - --devicecudacpu

执行步骤

  1. 解析路径:识别用户提供的音频文件或文件夹路径。
  2. 模式判断:根据用户意图判断使用 VoiceFixer(默认)还是 AudioSR(含 --hifi)。
  3. 默认目标:若未指定输出路径,默认在输入目录生成带 _enhanced_48k(AudioSR)或 _enhanced(VoiceFixer)后缀的文件。
  4. 调用命令:使用以下兼容性命令启动脚本(优先 python3,失败则 python)。脚本会自动检查环境、初始化模型并处理。
   (python3 scripts/enhancer.py -i "<输入路径>" [-o "<输出目录>"] [-m <0|1|2>] [--cuda] [-r] [--hifi] [--model_name <basic|speech>] [--ddim_steps <数值>] [--guidance_scale <数值>] [--seed <数值>] [--device <cuda|cpu>]) || (python scripts/enhancer.py -i "<输入路径>" [-o "<输出目录>"] [-m <0|1|2>] [--cuda] [-r] [--hifi] [--model_name <basic|speech>] [--ddim_steps <数值>] [--guidance_scale <数值>] [--seed <数值>] [--device <cuda|cpu>])

适合场景

01

OpenClaw 用户查找和安装 Skill 时

02

用户想查找某类 Agent Skill 时

03

需要根据任务场景推荐可安装能力包时

04

需要对比不同来源的安装命令和来源信息时

能力概览

能力 1

按任务关键词查找相关 Skills

能力 2

展示可复制的安装命令

能力 3

保留来源站点、仓库和原始说明,方便继续核验

能力 4

补充不同宿主或平台的使用分布数据

能力 5

展示第三方安全扫描或审计结果

安装后应在对应宿主中按原始 README 的触发条件使用;具体调用方式请以来源页面和 README 为准。

平台分布

OpenClaw

87.18%
按下载量换算1,339

安全审计

VirusTotal

可疑

ClawScan

通过

Static analysis

通过

权限和风险

权限需确认

当前来源未能明确判断权限范围,默认进入异常复核队列。

安装前确认

本站仅展示第三方公开信息,不托管安装包,不提供自动安装或运行环境。安装前应自行审查源码、依赖和命令行为。来源安全扫描存在 warning/failed 结果,不能写成本站确认安全。当前只有一个来源,正式发布前建议补源仓库或其他目录站核验。

来源信息

继续浏览同类 Skills