Token导航 LogoToken导航TokenDH.com
效率敏感数据clawhub未标认证来源可访问clear审计通过

feishu-voice-chat飞书语音聊天

Agent Skill

用于辅助音频、音乐、语音转写、语音合成或声音素材处理。它适合让 Agent 生成配乐说明、整理音频流程、调用语音工具或处理播客和视频配音素材。使用时需要确认输入音频来源、输出格式、时长和模型限制;涉及人声克隆、版权音乐或公开发布时,应先核对授权和合规边界。

总安装

5,364

周安装

217

GitHub Stars

公开资料未说明

下载量

1,684
OpenClaw

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

GitHub

来源数

2

许可证

MIT-0

最后核验

2026-05-01

来源状态

来源可访问

安装方式

通过对话安装

复制提示词发给支持本地命令或 Skills 的 AI 助手,先确认命令和权限,再让它执行。

请帮我安装这个 Agent Skill:feishu-voice-chat(飞书语音聊天)
来源仓库:https://github.com/li-neo/feishu-voice-chat
安装命令:
openclaw skills install feishu-voice-chat
安装前请先检查当前环境是否支持对应 CLI,并向我确认将要执行的命令、安装目录、联网范围和文件读写权限;确认后再执行。

命令行安装

复制命令到本机终端执行。该命令会通过 OpenClaw 从第三方来源获取 Skill;本站只展示命令,不托管安装包,也不自动执行。

ClawHubOpenClaw
openclaw skills install feishu-voice-chat

简介

飞书语音聊天提供 ASR 和 TTS 功能,处理完整语音交互链路。

  • 适用于接收用户语音并回复语音消息的场景。feishu-voice-chat 属于效率类 Skill,可作为该场景下的辅助能力补充。
  • 通过 clawhub 安装,需结合来源仓库和 README 确认具体用法。
  • 安装前建议确认权限范围和维护状态,注意是否触发联网或文件读写。
  • 涉及语音识别时应核对输入音频来源和模型限制。

SKILL.md

name
feishu-voice-chat
description
|
usage
parameters
asr
audio_path
type
string
description
待识别的音频文件绝对路径(支持 ogg、opus、mp3、wav)
required
true
tts
text
type
string
description
需要转换为语音的文本内容
required
true
output_path
type
string
description
生成的音频文件保存路径(可选,默认 /tmp/openclaw/voice-tts/reply_{timestamp}.ogg)
required
false
reply_to
type
string
description
回复目标消息 ID(可选,用于在话题中回复)
required
false
dependencies
env
description
火山引擎应用 ID
required
true
description
火山引擎访问令牌
required
true
description
TTS 资源 ID (默认: seed-tts-1.0)
required
false
description
TTS 音色代码
required
false
description
ASR 资源 ID
required
false

飞书语音对话 (Feishu Voice Chat)

本 Skill 集成了火山引擎 (Volcengine) 的语音技术,赋予 OpenClaw 机器人"听"和"说"的能力。

完整语音交互链路

用户(手机飞书 App)
    │
    ▼ 发送语音消息
┌──────────────────────────────────────────────────────────────┐
│ 飞书服务器                                                    │
│  • 语音格式:OGG 容器 + Opus 编码 + 48kHz 采样               │
│  • 消息类型:msg_type="audio"                               │
│  • content: {"file_key": "file_xxx", "duration": 5000}      │
└──────────────────────────────────────────────────────────────┘
    │
    ▼ OpenClaw 接收事件
┌──────────────────────────────────────────────────────────────┐
│ openclaw-lark 插件                                           │
│  • convertAudio() 解析 file_key                              │
│  • 下载语音到本地临时文件(/tmp/openclaw/media/inbound/*.ogg)│
│  • AI 收到:<audio key="file_xxx" duration="5s"/> + 文件路径  │
└──────────────────────────────────────────────────────────────┘
    │
    ▼ 调用 ASR
┌──────────────────────────────────────────────────────────────┐
│ feishu-voice-chat / ASR(语音→文字)                          │
│  • volc_voice.py asr <本地音频路径>                           │
│  • 火山引擎大模型 ASR (V3),高精度识别                       │
│  • 返回 JSON: {"status": "success", "text": "识别出的文字"}   │
└──────────────────────────────────────────────────────────────┘
    │
    ▼ LLM 处理
┌──────────────────────────────────────────────────────────────┐
│ OpenClaw LLM                                                 │
│  • 理解用户意图,生成回复内容                                  │
│  • 若需要语音回复 → 进入 TTS 流程                              │
└──────────────────────────────────────────────────────────────┘
    │
    ▼ 调用 TTS
┌──────────────────────────────────────────────────────────────┐
│ feishu-voice-chat / TTS(文字→语音)                          │
│  • feishu_voice.py speak <回复文本> [output_path] [reply_to]  │
│  • 火山引擎大模型 TTS (V3),生成 .ogg 音频文件                │
│  • 自动返回 message 工具调用指令                              │
└──────────────────────────────────────────────────────────────┘
    │
    ▼ 调用 message 工具发送
┌──────────────────────────────────────────────────────────────┐
│ openclaw-lark 插件 / message 工具                             │
│  • message(action="send", channel="feishu",                  │
│  •           msg_type="audio", media="<audio_file_path>")    │
│  • 内部自动:uploadFileLark(file_type="opus") → 获得 file_key │
│  •          sendAudioLark(content={"file_key": "file_xxx"})  │
│  • 用户收到:语音气泡(audio 消息,可直接播放)                 │
└──────────────────────────────────────────────────────────────┘
    │
    ▼
用户(手机飞书 App)

功能特性

  • 高精度语音识别 (ASR): 使用火山引擎大模型 ASR (V3),支持长语音和流式识别,准确率高。
  • 自然语音合成 (TTS): 使用火山引擎 TTS (V3),输出 .ogg 格式(适配飞书语音消息),支持流式生成。
  • 飞书插件深度集成: 通过 openclaw-lark 的 message 工具自动上传并发送语音消息,用户收到的是可直接播放的语音气泡。

前置准备

  1. 注册火山引擎账号: 访问 火山引擎语音服务控制台
  2. 创建应用: 在控制台创建一个应用,获取 AppIDAccess Token注意:这是语音服务的凭证,不同于火山引擎 ARK API 的 Key)。
  3. 开通服务: 为应用开通「大模型语音合成 TTS」和「大模型录音文件识别 ASR」两个服务。
  4. 安装依赖: pip install -r requirements.txt

配置说明

  1. 复制 .env.example.env
    cp .env.example .env
  1. 编辑 .env,填入你的火山引擎凭证:
    VOLC_APPID=你的AppID
    VOLC_ACCESS_TOKEN=你的Access Token
变量名说明默认值
VOLC_APPID火山引擎应用 ID(必填)-
VOLC_ACCESS_TOKEN访问令牌(必填)-
VOLC_RESOURCE_IDTTS 资源 IDseed-tts-1.0
VOLC_VOICE_TYPETTS 音色代码zh_female_sajiaonvyou_moon_bigtts
VOLC_RESOURCE_ID_ASRASR 资源 IDvolc.bigasr.auc

使用指南

1. 语音识别(ASR)—— 语音 → 文字

当机器人收到用户语音消息时,使用此命令将音频转为文本。

python3 scripts/volc_voice.py asr /path/to/user_audio.ogg

输出示例 (JSON):

{"status": "success", "text": "你好,请问今天天气怎么样?"}

2. 语音合成(TTS)—— 文字 → 语音

当需要回复语音时,使用此命令将文本转为音频,并自动生成 message 工具调用指令。

# 基本用法
python3 scripts/feishu_voice.py speak "今天天气不错,适合出去玩哦。"

# 指定输出路径和回复目标(在话题中回复)
python3 scripts/feishu_voice.py speak "好的没问题!" /tmp/reply.ogg om_xxx

输出示例:

🔊 正在合成语音: 今天天气不错...
✅ 合成成功: /tmp/openclaw/voice-tts/reply_1234567890.ogg
{"status": "success", "audio_file": "/tmp/openclaw/voice-tts/reply_1234567890.ogg", "message_cmd": "message(action=\"send\", channel=\"feishu\", msg_type=\"audio\", media=\"/tmp/openclaw/voice-tts/reply_1234567890.ogg\")"}

============================================================
音频文件 / Audio file: /tmp/openclaw/voice-tts/reply_1234567890.ogg
发送指令 / Send command: message(action="send", channel="feishu", msg_type="audio", media="/tmp/openclaw/voice-tts/reply_1234567890.ogg")
============================================================

OpenClaw Agent 接入指南

在 Agent System Prompt 中添加以下指令

语音交互能力: * 当用户发送语音消息(你会收到一个文件路径或 <audio key="..."/> 占位符)时,请调用 feishu-voice-chat 的 ASR 功能识别内容。 * 当用户要求"语音回复/说给我听"时,请先生成文本回复,然后调用 feishu-voice-chat 的 TTS 功能生成 .ogg 音频文件,最后使用飞书插件的 message 工具将音频以 msg_type="audio" 发送给用户。 * 重要:语音回复只发送语音消息,不发送文本消息,不发送文件附件。用户收到的是可直接播放的语音气泡。

工具调用示例(供 Agent 参考)

接收用户语音:

# 用户发送语音 → AI 调用 ASR
python3 scripts/volc_voice.py asr /tmp/openclaw/media/inbound/voice_xxx.ogg
# → 返回: {"status": "success", "text": "你好"}

# AI 处理后决定语音回复 → 调用 TTS
python3 scripts/feishu_voice.py speak "你好,有什么可以帮助你的吗?"
# → 返回 JSON 含 audio_file 和 message_cmd

# AI 调用 message 工具发送语音
message(action="send", channel="feishu", msg_type="audio", media="/tmp/openclaw/voice-tts/reply_xxx.ogg")
# → 用户在飞书收到语音气泡

测试步骤

  1. 配置凭证后,运行 TTS 测试:
    cd /Users/bytedance/.openclaw/workspace/skills/feishu-voice-chat
    python3 scripts/feishu_voice.py speak "你好,这是飞书语音对话测试。"

*验证*: 终端输出 ✅ 合成成功,且生成 /tmp/openclaw/voice-tts/reply_*.ogg 文件。

  1. 运行 ASR 测试:
    python3 scripts/volc_voice.py asr /tmp/openclaw/voice-tts/reply_*.ogg

*验证*: 终端输出 {"status": "success", "text": "..."},识别出的文字与 TTS 输入一致。

  1. 完整链路测试: 在飞书 App 中对机器人发送一条语音,观察 Agent 是否正确识别并语音回复。

故障排除

  • Error: 请在 .env 文件中配置...: 检查 .env 文件是否存在且内容正确。
  • Requested resource not granted (45000030):

* 检查 VOLC_RESOURCE_ID 是否正确。 * 如果是 TTS,尝试使用 seed-tts-1.0。 * 如果是 ASR,尝试使用 volc.bigasr.auc。 * 确认你的火山引擎应用是否已关联了相应的语音技术服务。

  • TTS/ASR Timeout: 检查网络连接,确保能访问 openspeech.bytedance.com
  • 飞书发送失败: 确认 openclaw-lark 插件已正确安装并配置了飞书机器人。

适合场景

01

OpenClaw 用户查找和安装 Skill 时

02

用户想查找某类 Agent Skill 时

03

需要根据任务场景推荐可安装能力包时

04

需要对比不同来源的安装命令和来源信息时

能力概览

能力 1

按任务关键词查找相关 Skills

能力 2

展示可复制的安装命令

能力 3

保留来源站点、仓库和原始说明,方便继续核验

能力 4

补充不同宿主或平台的使用分布数据

能力 5

展示第三方安全扫描或审计结果

安装后应在对应宿主中按原始 README 的触发条件使用;具体调用方式请以来源页面和 README 为准。

平台分布

OpenClaw

81.69%
按下载量换算1,376

安全审计

VirusTotal

通过

ClawScan

通过

Static analysis

通过

权限和风险

敏感数据

该 Skill 可能接触密钥、Token、环境变量或敏感配置,应进入高风险复核队列,默认不自动发布。

安装前确认

本站仅展示第三方公开信息,不托管安装包,不提供自动安装或运行环境。安装前应自行审查源码、依赖和命令行为。当前只有一个来源,正式发布前建议补源仓库或其他目录站核验。

来源信息

继续浏览同类 Skills