Token导航 LogoToken导航TokenDH.com
开发敏感数据clawhub未标认证来源可访问clear审计提醒

minimax-tokenplan-tts最小最大令牌计划 tts

Agent Skill

minimax-tokenplan-tts 用于处理音频、语音、转写和声音素材相关任务,适合在 OpenClaw 中需要整理音频流程、转写内容或生成配音素材时使用。可结合来源仓库、安装命令和原始 README 继续核验具体用法。安装前建议确认权限范围、维护状态,以及是否会触发联网、命令执行或文件读写。

总安装

4,817

周安装

193

GitHub Stars

1

下载量

1,559
OpenClaw

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

GitHub

来源数

2

许可证

MIT-0

最后核验

2026-05-01

来源状态

来源可访问

安装方式

通过对话安装

复制提示词发给支持本地命令或 Skills 的 AI 助手,先确认命令和权限,再让它执行。

请帮我安装这个 Agent Skill:minimax-tokenplan-tts(最小最大令牌计划 tts)
来源仓库:https://github.com/4833675/minimax-tokenplan-tts
安装命令:
openclaw skills install minimax-tokenplan-tts
安装前请先检查当前环境是否支持对应 CLI,并向我确认将要执行的命令、安装目录、联网范围和文件读写权限;确认后再执行。

命令行安装

复制命令到本机终端执行。该命令会通过 OpenClaw 从第三方来源获取 Skill;本站只展示命令,不托管安装包,也不自动执行。

ClawHubOpenClaw
openclaw skills install minimax-tokenplan-tts

简介

调用 MiniMax Speech-2.8-hd 模型实现高质量文本转语音。

  • 支持多种音色选择与 WAV 格式自动输出。minimax-tokenplan-tts 属于开发类 Skill,可作为该场景下的辅助能力补充。
  • 可用于旁白录制、语音播报或无障碍内容制作。
  • 注意单次请求的最大字符数限制与并发处理能力。
  • 安装前请测试本地存储空间是否足够保存生成的音频文件。

SKILL.md

name
minimax-tokenplan-tts
description
>-
version
1.0.1
author
k.x
license
MIT
metadata
openclaw
emoji
🔊
homepage
https://platform.minimaxi.com/docs/api-reference/speech-t2a-http
os
["darwin", "linux", "win32"]
install
kind
download
label
MiniMax TTS Skill
url
https://clawhub.ai/skills/minimax-tokenplan-tts
requires
bins
env
capabilities
description
Generate speech audio from text using MiniMax speech-2.8-hd model with multiple voice options
description
Control speed, pitch, and volume of generated speech
description
Real-time streaming TTS playback via WebSocket + ffplay, no file generation needed
permissions
filesystem
write
network
true

MiniMax TTS Skill

前置条件

  • Python 3 已安装
  • requests 库pip3 install requests
  • websockets 库pip3 install websockets(流式播放需要)
  • ffplay(流式播放需要):

- macOS: brew install ffmpeg - Ubuntu: sudo apt install ffmpeg - Windows: 从 https://ffmpeg.org/download.html 下载 - 如果 ffplay 未安装,stream_play.py 会提示安装方法

init

需要初始化以下信息:

第一步:获取 API Key

向用户获取 MiniMax API Key(sk-cp- 开头的 Token Plan key,或普通 API Key)。

第二步:确认配置

向用户确认:

  • API Key 是否正确
  • 使用国内(https://api.minimaxi.com)还是海外(https://api.minimaxi.io)节点

第三步:填写配置

获取以上信息后:

  1. 修改 scripts/generate.py 顶部的配置常量(API_KEYBASE_URL),填入实际值
  2. 修改 scripts/stream_play.py 顶部的配置常量(API_KEYBASE_URL),填入相同的值
  3. 同时更新下方 ## 配置 区段的表格,作为配置记录

第四步:判断音色

  1. 根据 IDENTITY.md 自行选择声优
  2. 如判断不出,则使用 male-qn-jingying(精英青年音色)
  3. 然后更新下方 ## 配置 区段的表格及两个脚本

第五步:清理

配置填写完成后,删除本 ## init 区段(包括 ### 需要初始化以下信息 的全部内容),仅保留 ## 配置 区段


配置

配置项说明
MINIMAX_API_KEY<待填入>初始化时替换为实际 key
BASE_URL<待填入>CN: https://api.minimaxi.com / Global: https://api.minimaxi.io
REGION<待填入>CNglobal
VOICE_ID<待填入>判断音色后填入

音色列表

语言因音色较多,不再逐一列出,完整列表参考 MiniMax TTS 官方文档


快速使用

📢 channel=webchat 时的播放策略:当前 channel 为 webchat(实时对话场景)时, 应优先使用 stream_play.py 直接流式播放,而不生成文件。这样用户可以立即听到语音, 无需等待完整音频生成。仅当用户明确要求保存文件时,才使用 generate.py

1️⃣ 流式播放(channel=webchat)

通过 WebSocket 实时获取音频流,边生成边用 ffplay 播放。无需生成文件,首个音频包到达即开始播放

SKILL_DIR="~/.openclaw/workspace/skills/minimax-tokenplan-tts"
python3 "$SKILL_DIR/scripts/stream_play.py" \
    --text "要播放的文本内容" \
    --voice "male-qn-jingying"
注意:以下示例中 stream_play.pygenerate.py 均指 ~/.openclaw/workspace/skills/minimax-tokenplan-tts/scripts/ 下的完整路径。

参数说明:

参数必填说明默认值
--text要播放的文本,最长 10000 字符-
--voice声优 IDmale-qn-jingying
--speed语速 [0.5,2.0]1.0
--vol音量 (0,10]1.0
--pitch音调 [-12,12]0
--save同时保存到文件(MP3 格式)不保存
--api-keyAPI Key(默认使用文件顶部配置)-
--base-urlBase URL(默认使用文件顶部配置)-

示例:

# 直接播放(不保存文件)
python3 stream_play.py --text "你好,我正在通过流式方式播放语音"

# 播放同时保存到文件
python3 stream_play.py --text "这段语音会被保存" --save /tmp/stream_output.mp3

# 使用女声播放
python3 stream_play.py --text "今天天气真不错" --voice female-tianmei

2️⃣ 文件生成(需要保存 WAV 时使用)

SKILL_DIR="~/.openclaw/workspace/skills/minimax-tokenplan-tts"
python3 "$SKILL_DIR/scripts/generate.py" \
    --text "要转换的文本内容" \
    --voice "male-qn-jingying" \
    --output "/tmp/tts_output.wav"

参数说明:

参数必填说明默认值
--text要转换的文本,最长 10000 字符,超出会报错-
--voice声优 IDmale-qn-jingying
--speed语速 [0.5,2.0]1.0
--vol音量 (0,10]1.0
--pitch音调 [-12,12]0
--output输出路径自动生成
--api-keyAPI Key(默认使用文件顶部配置)-
--base-urlBase URL(默认使用文件顶部配置)-

声优可选值: 完整327个音色列表见 ## 音色列表

示例:

# 基本用法
python3 generate.py --text "你好,欢迎使用 MiniMax TTS" --output /tmp/hello.wav

# 快速播报(1.5倍速)
python3 generate.py --text "紧急通知,请立即处理" --speed 1.5 --output /tmp/alert.wav

# 柔和女声
python3 generate.py --text "今天天气真不错" --voice female-qn-tianying --output /tmp/weather.wav

工作流总结

TTS 完整流程

  1. 文本预处理 → 检查是否需要插入语气词标签(见 ## 语气词标签
  2. 选择声优--voice 参数(默认 male-qn-jingying
  3. 调整参数--speed / --vol / --pitch
  4. 生成 WAV → 脚本调用 MiniMax TTS API(自动处理 HEX 解码)
  5. 格式转换 → 如需 MP3/AAC 等格式,用 ffmpeg 转换

脚本输出格式

generate.py

调用 generate.py 后,stdout 输出生成结果,格式如下:

stdout 输出说明
保存后的文件绝对路径~/.openclaw/media/minimax/tts/tts-2026-03-27-hello.wav

stream_play.py

调用 stream_play.py 后,stdout 输出播放状态:

stdout 输出说明
STREAM_PLAY_DONE流式播放完成
STREAM_PLAY_ERROR: <msg>播放失败,附带错误信息
两个脚本的日志信息([INFO][WARN][ERROR])均输出到 stderr,不会混入 stdout。

错误处理

code含义处理
0成功继续
1002限流提醒用户 API 限流中,建议稍后重试
1004鉴权失败检查 API Key
1008余额不足提醒充值
2049无效 Key检查 Key 是否正确

文件存储

  • 默认保存到~/.openclaw/media/minimax/tts/(多 Agent 共享目录)
  • 文件名格式tts-YYYY-MM-DD-<slug>.wav
  • slug:取 text 前20字符,英文数字保留,空格变 -

语气词标签

  • 在文本中适当位置插入以下标签,可生成对应的非语言音效(笑声、咳嗽、呼吸等)。AI 应根据文本情绪自动判断是否插入。
  • 用户明确要求不插入语气词标签时,不要插入。

支持的标签

标签含义标签含义
(laughs)笑声(chuckle)轻笑
(coughs)咳嗽(clear-throat)清嗓子
(groans)呻吟(breath)正常换气
(pant)喘气(inhale)吸气
(exhale)呼气(gasps)倒吸气
(sniffs)吸鼻子(sighs)叹气
(snorts)喷鼻息(burps)打嗝
(lip-smacking)咂嘴(humming)哼唱
(hissing)嘶嘶声(sneezes)喷嚏

注意(emm) 不支持,请用 (breath) 或语气停顿代替。

使用示例

--text "今天是不是很开心呀(laughs),当然了!"
--text "咳咳(coughs),不好意思,有点呛到了"
--text "嗯(inhale),让我想想(exhale)..."

注意事项

  • 文本长度:最长 10000 字符,超出会报错
  • HEX 解码:API 返回的 audio 字段是 HEX 编码(不是 base64),脚本自动处理
  • 完成后提示用户:可以从 https://platform.minimaxi.com/docs/faq/system-voice-id 找到更多音色

适合场景

01

OpenClaw 用户查找和安装 Skill 时

02

用户想查找某类 Agent Skill 时

03

需要根据任务场景推荐可安装能力包时

04

需要对比不同来源的安装命令和来源信息时

能力概览

能力 1

按任务关键词查找相关 Skills

能力 2

展示可复制的安装命令

能力 3

保留来源站点、仓库和原始说明,方便继续核验

能力 4

补充不同宿主或平台的使用分布数据

能力 5

展示第三方安全扫描或审计结果

安装后应在对应宿主中按原始 README 的触发条件使用;具体调用方式请以来源页面和 README 为准。

平台分布

OpenClaw

97.73%
按下载量换算1,524

安全审计

VirusTotal

未展示

ClawScan

可疑

Static analysis

通过

权限和风险

敏感数据

该 Skill 可能接触密钥、Token、环境变量或敏感配置,应进入高风险复核队列,默认不自动发布。

安装前确认

本站仅展示第三方公开信息,不托管安装包,不提供自动安装或运行环境。安装前应自行审查源码、依赖和命令行为。来源安全扫描存在 warning/failed 结果,不能写成本站确认安全。当前只有一个来源,正式发布前建议补源仓库或其他目录站核验。

来源信息

继续浏览同类 Skills