Token导航 LogoToken导航TokenDH.com
效率external-serviceclawhub未标认证来源可访问clear审计提醒

feishu-speaker飞鼠音箱

Agent Skill

feishu-speaker 用于补充效率相关能力,适合在 OpenClaw 中需要让 Agent 承接效率相关任务时使用。可结合来源仓库、安装命令和原始 README 继续核验具体用法。安装前建议确认权限范围、维护状态,以及是否会触发联网、命令执行或文件读写。

总安装

14,041

周安装

597

GitHub Stars

公开资料未说明

下载量

4,919
OpenClaw

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

GitHub

来源数

2

许可证

MIT-0

最后核验

2026-05-01

来源状态

来源可访问

安装方式

通过对话安装

复制提示词发给支持本地命令或 Skills 的 AI 助手,先确认命令和权限,再让它执行。

请帮我安装这个 Agent Skill:feishu-speaker(飞鼠音箱)
来源仓库:https://github.com/tel18610240060-collab/feishu-speaker
安装命令:
openclaw skills install feishu-speaker
安装前请先检查当前环境是否支持对应 CLI,并向我确认将要执行的命令、安装目录、联网范围和文件读写权限;确认后再执行。

命令行安装

复制命令到本机终端执行。该命令会通过 OpenClaw 从第三方来源获取 Skill;本站只展示命令,不托管安装包,也不自动执行。

ClawHubOpenClaw
openclaw skills install feishu-speaker

简介

飞书语音消息工具,支持语音转文字接收和文字转语音发送。

  • 适用于需要处理飞书语音消息的场景,如会议记录或语音回复。
  • 通过 TTS 和 Whisper 技术实现双向语音交互功能。
  • 安装命令:openclaw skills install feishu-speaker。
  • 使用前请确认飞书 API 权限及网络连接状态。

SKILL.md

name
feishu-speaker
description
飞书双向语音消息工具 - 支持语音转文字接收和文字转语音发送(TTS+Whisper)
version
1.1.0
author
巴克

feishu-speaker Skill v1.0

飞书双向语音消息工具 - 让AI助手像真人一样语音交流

支持双向:接收语音(转文字)+ 发送语音(TTS) ✅ 智能回复:根据接收消息类型自动选择回复方式

🎯 核心特性

🎤 接收语音(语音 → 文字)

  • 使用 OpenAI Whisper 本地转录
  • 支持中文语音识别
  • 无需联网,本地处理

🔊 发送语音(文字 → 语音)

  • 使用 Edge-TTS 生成高质量语音
  • 支持多种中文音色(男/女/年轻/成熟)
  • 可调节语速(0.5x - 2.0x)

🔄 智能交互

  • 收到语音消息 → 自动转文字理解 → 语音回复
  • 收到文字消息 → 文字理解 → 根据配置选择回复方式

📦 安装依赖

# 1. 安装Whisper(语音转文字)
pip install openai-whisper

# 2. 安装Edge-TTS(文字转语音)
npm install -g edge-tts

# 3. 安装FFmpeg(音频格式转换)
# macOS: brew install ffmpeg
# Ubuntu: apt-get install ffmpeg

🚀 快速开始

1. 配置飞书API凭证

创建文件 ~/.openclaw/.credentials/feishu-app-secret.txt

你的飞书App Secret

获取方式:

  1. 访问 https://open.feishu.cn/app/
  2. 进入你的应用 → 凭证与基础信息
  3. 复制 App Secret

2. 接收语音(自动转文字)

# 转录收到的语音消息
feishu-speaker listen voice.ogg

# 使用更大的模型(更准确但更慢)
feishu-speaker listen voice.ogg --model small

3. 发送语音消息

# 基本使用
feishu-speaker say "你好,这是语音消息"

# 指定音色
feishu-speaker say "晚上好" --voice zh-CN-YunxiNeural

# 调整语速
feishu-speaker say "加快速度" --rate "+30%"

4. 智能回复

# 根据收到的消息类型自动选择回复方式
feishu-speaker reply "收到,我马上处理"

🎨 支持的音色

音色ID性别风格推荐场景
zh-CN-YunxiNeural年轻、干脆利落 ⭐日常交流、快速回复
zh-CN-YunjianNeural成熟稳重正式场合、商务沟通
zh-CN-XiaoxiaoNeural标准女声温和回复、客服场景
zh-CN-XiaoyiNeural温柔女声亲切交流、情感场景

🔧 命令详解

feishu-speaker listen - 语音转文字

feishu-speaker listen <音频文件> [选项]

选项:
  -m, --model <模型>    Whisper模型(tiny/base/small,默认:base)
  -l, --language <语言> 指定语言(默认:zh)
  -o, --output <文件>   输出到文件

示例:
  feishu-speaker listen message.ogg
  feishu-speaker listen voice.mp3 --model small

feishu-speaker say - 文字转语音并发送

feishu-speaker say <文字内容> [选项]

选项:
  -v, --voice <音色>    指定音色(默认:zh-CN-YunxiNeural)
  -r, --rate <速率>     语速调整(默认:+20%)
  -t, --to <用户ID>     指定接收者
  -s, --save <文件>     保存音频文件(不发送)

示例:
  feishu-speaker say "你好"
  feishu-speaker say "会议开始" --voice zh-CN-YunjianNeural
  feishu-speaker say "快速播报" --rate "+50%"

feishu-speaker reply - 智能回复

feishu-speaker reply <文字内容> [选项]

选项:
  --voice               强制语音回复
  --text                强制文字回复
  --auto                根据对方消息类型自动选择(默认)

示例:
  feishu-speaker reply "收到"
  feishu-speaker reply "好的" --voice

⚙️ 配置选项

配置文件:~/.openclaw/skills/feishu-speaker/config/config.json

{
  "default_voice": "zh-CN-YunxiNeural",
  "default_rate": "+20%",
  "default_volume": "+0%",
  "default_pitch": "default",
  "reply_mode": "auto",
  "app_id": "cli_a9037acd2ba19bb5",
  "receiver_id": "ou_94f3936f1896b5378404f377da3fae6f"
}

配置说明:

  • default_voice: 默认TTS音色
  • default_rate: 默认语速(+20% = 1.2倍速)
  • reply_mode: 回复模式

- auto: 自动匹配(语音→语音,文字→文字) - voice: 总是语音回复 - text: 总是文字回复


📝 使用场景

场景1:AI助手语音交互

# 用户发送语音 → AI转录理解 → 语音回复
# 自动流程:
# 1. 用户:发送语音"帮我查一下明天的天气"
# 2. AI:feishu-speaker listen voice.ogg → 转录为文字
# 3. AI:处理请求 → feishu-speaker reply "明天北京晴天,25度"

场景2:定时语音播报

# 在cron任务中使用
feishu-speaker say "早上好!今日热点已更新,请查看。"

场景3:多音色切换

# 正式场合
feishu-speaker say "会议将在10分钟后开始。" --voice zh-CN-YunjianNeural

# 活泼场合  
feishu-speaker say "好消息!任务提前完成了!" --voice zh-CN-YunxiNeural --rate "+30%"

🔌 技术架构

接收语音流程:
┌─────────────┐     ┌─────────────┐     ┌─────────────┐
│  飞书语音消息  │ ──→ │  Whisper    │ ──→ │   文字结果   │
│  (ogg格式)   │     │  (本地转录)  │     │  (中文文本)  │
└─────────────┘     └─────────────┘     └─────────────┘

发送语音流程:
┌─────────────┐     ┌─────────────┐     ┌─────────────┐     ┌─────────────┐
│   文字输入   │ ──→ │  Edge-TTS   │ ──→ │   FFmpeg    │ ──→ │  飞书API    │
│  (中文文本)  │     │  (生成MP3)  │     │ (转opus/ogg)│     │ (发送语音)  │
└─────────────┘     └─────────────┘     └─────────────┘     └─────────────┘

⚠️ 注意事项

  1. 音频格式:飞书语音消息支持 opus/ogg 格式,脚本会自动转换
  2. 文件大小:单条语音建议不超过 10MB
  3. 语速范围:支持 -50% 到 +100%,建议 +20% 左右最自然
  4. 网络要求:发送语音需要访问飞书API(国内网络即可)
  5. 隐私安全:语音转文字在本地处理,不上传到云端

🐛 故障排查

Whisper模型下载失败

# 手动下载模型
python3 -c "import whisper; whisper.load_model('base')"

飞书API返回错误

  1. 检查 App Secret 是否正确配置
  2. 检查接收者ID格式(应以 ou_ 开头)
  3. 检查音频文件格式是否为 opus/ogg

Edge-TTS安装失败

# 使用npx直接运行
npx edge-tts "测试" --voice zh-CN-YunxiNeural --write-media output.mp3

📊 与其他skill对比

功能feishu-voicefeishu-speaker (本skill)
发送语音
接收语音(转文字)
双向交互
智能回复模式
多音色支持
语速调节

🔄 更新计划

v1.1.0 (计划中)

  • [ ] 支持更多语音合成引擎(Azure、科大讯飞)
  • [ ] 支持语音情感调节(开心、严肃、温柔)
  • [ ] 支持实时语音对话(WebSocket)

v1.2.0 (计划中)

  • [ ] 支持语音克隆(自定义音色)
  • [ ] 支持语音转写后自动摘要
  • [ ] 支持批量语音处理

📄 License

MIT License


让飞书沟通更自然,像真人一样语音交流! 🎙️✨


🚀 新增:一键语音回复

reply-voice 脚本(v1.1.0新增)

功能:自动处理完整的语音消息回复流程

  • 接收语音消息 → 转录为文字 → 生成语音回复 → 发送

用法

# 转录语音并发送回复
reply-voice voice.ogg "这是回复内容"

# 仅转录,不发送
reply-voice voice.ogg

完整流程

┌─────────────┐    ┌─────────────┐    ┌─────────────┐    ┌─────────────┐
│ 飞书语音消息 │ → │  Whisper   │ → │  Edge-TTS  │ → │  飞书API    │
│  (ogg格式)  │    │  转录文字   │    │  生成语音   │    │  发送语音   │
└─────────────┘    └─────────────┘    └─────────────┘    └─────────────┘

依赖

  • Python 3.8+
  • openai-whisper
  • edge-tts
  • ffmpeg

适合场景

01

OpenClaw 用户查找和安装 Skill 时

02

用户想查找某类 Agent Skill 时

03

需要根据任务场景推荐可安装能力包时

04

需要对比不同来源的安装命令和来源信息时

能力概览

能力 1

按任务关键词查找相关 Skills

能力 2

展示可复制的安装命令

能力 3

保留来源站点、仓库和原始说明,方便继续核验

能力 4

补充不同宿主或平台的使用分布数据

能力 5

展示第三方安全扫描或审计结果

安装后应在对应宿主中按原始 README 的触发条件使用;具体调用方式请以来源页面和 README 为准。

平台分布

OpenClaw

95.62%
按下载量换算4,704

安全审计

VirusTotal

可疑

ClawScan

可疑

Static analysis

未展示

权限和风险

external-service

该 Skill 可能调用第三方服务、云服务或外部模型 API,使用前需要确认账号、额度、数据发送范围和服务条款。

安装前确认

本站仅展示第三方公开信息,不托管安装包,不提供自动安装或运行环境。安装前应自行审查源码、依赖和命令行为。来源安全扫描存在 warning/failed 结果,不能写成本站确认安全。当前只有一个来源,正式发布前建议补源仓库或其他目录站核验。

来源信息

继续浏览同类 Skills