Token导航 LogoToken导航TokenDH.com
效率需要联网clawhub未标认证来源可访问clear审计提醒

feishu-minimax-t2a-voice飞书 minimax t2a 语音

Agent Skill

用于辅助音频、音乐、语音转写、语音合成或声音素材处理。它适合让 Agent 生成配乐说明、整理音频流程、调用语音工具或处理播客和视频配音素材。使用时需要确认输入音频来源、输出格式、时长和模型限制;涉及人声克隆、版权音乐或公开发布时,应先核对授权和合规边界。

总安装

3,623

周安装

148

GitHub Stars

1

下载量

1,160
OpenClaw

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

GitHub

来源数

2

许可证

MIT-0

最后核验

2026-05-01

来源状态

来源可访问

安装方式

通过对话安装

复制提示词发给支持本地命令或 Skills 的 AI 助手,先确认命令和权限,再让它执行。

请帮我安装这个 Agent Skill:feishu-minimax-t2a-voice(飞书 minimax t2a 语音)
来源仓库:https://github.com/michelangelo-in-sistine/feishu-minimax-t2a-voice
安装命令:
openclaw skills install feishu-minimax-t2a-voice
安装前请先检查当前环境是否支持对应 CLI,并向我确认将要执行的命令、安装目录、联网范围和文件读写权限;确认后再执行。

命令行安装

复制命令到本机终端执行。该命令会通过 OpenClaw 从第三方来源获取 Skill;本站只展示命令,不托管安装包,也不自动执行。

ClawHubOpenClaw
openclaw skills install feishu-minimax-t2a-voice

简介

飞书语音消息收发:接收语音自动转文字(飞书原生 Transcript + Whisper 降级),回复语音由 MiniMax T2A 合成后发送。

SKILL.md

name
feishu-voice
description
当用户发来语音消息时, 使用此 feishu-voice SKILL以语音消息回复。version: "1.0.2
metadata
{"clawdbot":{"emoji":"🎙️","requires":{"bins":["ffmpeg(仅 MiniMax 链路需要)"],"env":["MINIMAX_API_KEY(可选)"]}}}

feishu-voice

接收:语音 → 文字

飞书自动为语音消息生成转写,消息体中自带 Transcript 字段,直接读取即可,无需任何 API 调用。


发送:文字 → 语音

流程

Step 1. 调用脚本生成语音文件:

python scripts/reply.py "<文字内容>"

输出文件路径(格式为 .opus.ogg)。

Step 2. 通过飞书发送语音:

message(action=send, channel=feishu, media=<filepath>, contentType="audio/opus")

注:Edge TTS 输出的 .ogg 文件同样使用 audio/opus contentType。


MiniMax 语气词(配置了 MINIMAX_API_KEY 时)

在生成回复文本时主动嵌入以下标记,可让语音更自然:

标记含义使用场景
<#0.3#>停顿 0.3 秒逗号后、句子中间
(breath)自然呼吸长句中间、句末
(sighs)叹气感叹、无奈时
(emm)思考语气问句结尾、停顿后继续
(clear-throat)清嗓转折、开始说话
(laughs)笑声开心、幽默内容
(chuckle)轻笑轻松调侃
(sniffs)吸鼻子轻微情绪
(humming)哼唱愉快、自言自语

规则:

  • 标记插入两个有发音文本之间,不可连续叠加
  • 问句句尾加 (emm)
  • 感叹句插 (laughs)(sighs)
  • 句号前无自然停顿时加 (breath)
  • 长叙述每隔 20-30 字符插一次 (breath)<#0.3#>

示例:

模型生成文本:好的,那我们出发吧。
应生成:好的<#0.3#>,那我们出发吧(laughs)。

模型生成文本:等等,让我想想,这个怎么做来着?
应生成:等等<#0.3#>,让我想想(emm)<#0.4#>,这个怎么做来着?

模型生成文本:唉,今天真是太累了。
应生成:唉(sighs),今天真是太累了(breath)。

链路降级

MiniMax T2A (mp3) → ffmpeg → opus  [优先]
    ↓ 超时/无 key
Edge TTS (ogg 直出)                  [降级]
    ↓ 失败
返回纯文字(不走语音)

环境变量

变量必填说明
MINIMAX_API_KEY有则优先 MiniMax;无则 Edge TTS
EDGE_TTS_VOICEEdge TTS 音色,默认 zh-CN-XiaoxiaoNeural

快速参考

# 生成语音并发送
python scripts/reply.py "<文字>"  →  输出文件路径  →  message(media=路径, contentType="audio/opus")

适合场景

01

OpenClaw 用户查找和安装 Skill 时

02

用户想查找某类 Agent Skill 时

03

需要根据任务场景推荐可安装能力包时

04

需要对比不同来源的安装命令和来源信息时

能力概览

能力 1

按任务关键词查找相关 Skills

能力 2

展示可复制的安装命令

能力 3

保留来源站点、仓库和原始说明,方便继续核验

能力 4

补充不同宿主或平台的使用分布数据

能力 5

展示第三方安全扫描或审计结果

安装后应在对应宿主中按原始 README 的触发条件使用;具体调用方式请以来源页面和 README 为准。

平台分布

OpenClaw

92.68%
按下载量换算1,075

安全审计

VirusTotal

通过

ClawScan

可疑

Static analysis

通过

权限和风险

需要联网

该 Skill 可能需要联网访问来源站点、仓库或外部 API;具体网络访问范围需要结合源码和 README 复核。

安装前确认

本站仅展示第三方公开信息,不托管安装包,不提供自动安装或运行环境。安装前应自行审查源码、依赖和命令行为。来源安全扫描存在 warning/failed 结果,不能写成本站确认安全。当前只有一个来源,正式发布前建议补源仓库或其他目录站核验。

来源信息

继续浏览同类 Skills