Token导航 LogoToken导航TokenDH.com
效率敏感数据clawhub未标认证来源可访问clear审计提醒

voice-listener语音监听器

Agent Skill

用于辅助音频、音乐、语音转写、语音合成或声音素材处理。它适合让 Agent 生成配乐说明、整理音频流程、调用语音工具或处理播客和视频配音素材。使用时需要确认输入音频来源、输出格式、时长和模型限制;涉及人声克隆、版权音乐或公开发布时,应先核对授权和合规边界。

总安装

12,571

周安装

540

GitHub Stars

公开资料未说明

下载量

4,406
OpenClaw

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

GitHub

来源数

2

许可证

MIT-0

最后核验

2026-05-01

来源状态

来源可访问

安装方式

通过对话安装

复制提示词发给支持本地命令或 Skills 的 AI 助手,先确认命令和权限,再让它执行。

请帮我安装这个 Agent Skill:voice-listener(语音监听器)
来源仓库:https://github.com/fanqing203/voice-listener
安装命令:
openclaw skills install voice-listener
安装前请先检查当前环境是否支持对应 CLI,并向我确认将要执行的命令、安装目录、联网范围和文件读写权限;确认后再执行。

命令行安装

复制命令到本机终端执行。该命令会通过 OpenClaw 从第三方来源获取 Skill;本站只展示命令,不托管安装包,也不自动执行。

ClawHubOpenClaw
openclaw skills install voice-listener

简介

智能唤醒“小龙虾”,实现百度高精度语音识别,持续监听并自动输入语音内容,支持“停止”暂停输入。

SKILL.md

Voice Listener Skill

百度语音识别 + 智能唤醒技能

功能

  • 🎤 百度语音识别(高准确度)
  • ✨ 智能唤醒模式:"小龙虾"激活,"停止"暂停
  • 🔄 持续监听:激活后所有语音自动输入
  • 📋 无需每次都说唤醒词

快速开始

方式1:通过OpenClaw技能系统调用(推荐)

在对话中直接说或输入:

启动语音监听

OpenClaw会自动调用此技能并启动语音识别程序。

方式2:启动脚本

双击运行:

voice_input_baidu_smart.bat

方式3:命令行

在技能目录下运行:

python start_voice_listener.py

使用方法

激活模式

  1. 双击 voice_input_baidu_smart.bat 启动程序
  2. 程序进入待机模式
  3. 说:"小龙虾"
  4. 程序进入激活模式
  5. 所有语音都会自动识别并输入

持续输入

激活后,你说的话会自动输入到光标位置:

说: "你好" → 自动输入
说: "帮我打开淘宝" → 自动输入
说: "今天天气怎么样?" → 自动输入

暂停输入

说:"停止"

程序回到待机模式,不会再输入你的语音。

配置文件

百度 API 配置

编辑 baidu_config.json

{
  "APP_ID": "你的APP_ID",
  "API_KEY": "你的API_KEY",
  "SECRET_KEY": "你的SECRET_KEY"
}

修改唤醒词

编辑 voice_input_baidu_smart.py

# 唤醒词
WAKE_WORD = "小龙虾"  # 改成你喜欢的词

# 停止词
STOP_WORD = "停止"  # 改成你喜欢的词

工作流程

[待机模式]
   ↓
   说: "小龙虾" → [激活模式]
   ↓
   持续语音输入...
   ↓
   说: "停止" → [待机模式]

文件说明

核心文件

  • voice_input_baidu_smart.py - 智能唤醒模式(推荐)
  • voice_input_baidu_smart.bat - 启动脚本
  • baidu_config.json - 百度API配置

其他版本

  • voice_input_baidu.py - 简单持续监听(无唤醒词)
  • voice_input_baidu_wakeup.py - 单次唤醒版本
  • BAIDU_README.md - 百度API使用指南
  • SMART_WAKEUP_README.md - 智能唤醒详细指南

配置文件

  • baidu_config.json - 百度API密钥配置

技术参数

音频配置

  • 采样率:16000 Hz(百度要求)
  • 声道:1(单声道)
  • 格式:WAV
  • 静音阈值:0.02(可调)
  • 静音时长:1.5 秒(说话结束后停止录音)
  • 最短语音:0.5 秒(防止误触发)

API 配置

  • 识别引擎:百度语音识别 API
  • Token API:https://aip.baidubce.com/oauth/2.0/token
  • 识别 API:https://vop.baidu.com/server_api
  • 免费额度:50,000 次/天
  • 语言:普通话(支持简单英文)

优势

特性说明
✅ 高准确度百度语音识别准确度高
✅ 智能唤醒唤醒后持续工作
✅ 易控制明确的激活/停止
✅ 免费额度高每天50,000次
✅ 配置简单只需三个API密钥

常见问题

问题1:Token获取失败

错误: 无法获取百度Access Token

解决:

  1. 检查 baidu_config.json 中的密钥是否正确
  2. 检查网络连接
  3. 重新登录百度控制台,检查API密钥状态

问题2:唤醒词检测不到

解决:

  1. 清楚地说"小龙虾"
  2. 在安静环境下使用
  3. 靠近麦克风

问题3:停止词检测不到

解决:

  1. 清楚地说"停止"
  2. 或者按 Ctrl+C 停止程序

API 密钥申请

获取步骤

  1. 访问:https://ai.baidu.com/
  2. 注册/登录账号
  3. 进入控制台:https://console.bce.baidu.com/ai/
  4. 创建应用
  5. 选择"语音识别"
  6. 获取 APP ID, API Key, Secret Key
  7. 填入 baidu_config.json

文档

  • 百度AI开放平台:https://ai.baidu.com/
  • 语音识别文档:https://ai.baidu.com/ai-doc/SPEECH/Vk38lxily
  • 控制台地址:https://console.bce.baidu.com/ai/

输出

识别结果:

  • 自动输入到光标位置
  • 同时在控制台显示识别文本
  • 失败时复制到剪贴板,手动粘贴

技术栈

  • 音频处理:sounddevice
  • 键盘控制:keyboard
  • 剪贴板:pyperclip
  • 语音识别:百度 REST API
  • HTTP 请求:requests

适合场景

01

OpenClaw 用户查找和安装 Skill 时

02

用户想查找某类 Agent Skill 时

03

需要根据任务场景推荐可安装能力包时

04

需要对比不同来源的安装命令和来源信息时

能力概览

能力 1

按任务关键词查找相关 Skills

能力 2

展示可复制的安装命令

能力 3

保留来源站点、仓库和原始说明,方便继续核验

能力 4

补充不同宿主或平台的使用分布数据

能力 5

展示第三方安全扫描或审计结果

安装后应在对应宿主中按原始 README 的触发条件使用;具体调用方式请以来源页面和 README 为准。

平台分布

OpenClaw

94.33%
按下载量换算4,156

安全审计

VirusTotal

可疑

ClawScan

通过

Static analysis

未展示

权限和风险

敏感数据

该 Skill 可能接触密钥、Token、环境变量或敏感配置,应进入高风险复核队列,默认不自动发布。

安装前确认

本站仅展示第三方公开信息,不托管安装包,不提供自动安装或运行环境。安装前应自行审查源码、依赖和命令行为。来源安全扫描存在 warning/failed 结果,不能写成本站确认安全。当前只有一个来源,正式发布前建议补源仓库或其他目录站核验。

来源信息

继续浏览同类 Skills