Token导航 LogoToken导航TokenDH.com
效率敏感数据clawhub未标认证来源可访问clear审计通过

mimotts25mimotts25 控制

Agent Skill

mimotts25 用于处理音频、语音、转写和声音素材相关任务,适合在 OpenClaw 中需要整理音频流程、转写内容或生成配音素材时使用。可结合来源仓库、安装命令和原始 README 继续核验具体用法。安装前建议确认权限范围、维护状态,以及是否会触发联网、命令执行或文件读写。

总安装

3,857

周安装

164

GitHub Stars

公开资料未说明

下载量

1,351
OpenClaw

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

GitHub

来源数

2

许可证

MIT-0

最后核验

2026-05-01

来源状态

来源可访问

安装方式

通过对话安装

复制提示词发给支持本地命令或 Skills 的 AI 助手,先确认命令和权限,再让它执行。

请帮我安装这个 Agent Skill:mimotts25(mimotts25 控制)
来源仓库:https://github.com/aaroncxxx/mimotts25
安装命令:
openclaw skills install mimotts25
安装前请先检查当前环境是否支持对应 CLI,并向我确认将要执行的命令、安装目录、联网范围和文件读写权限;确认后再执行。

命令行安装

复制命令到本机终端执行。该命令会通过 OpenClaw 从第三方来源获取 Skill;本站只展示命令,不托管安装包,也不自动执行。

ClawHubOpenClaw
openclaw skills install mimotts25

简介

基于小米MiMo TTS 2.5实现高质量语音合成。

  • 支持中文/英文预设音色与情感、方言风格调节。
  • 可用于文本朗读与配音素材生成任务。
  • 安装命令:openclaw skills install mimotts25
  • 音色使用应符合平台内容安全政策mimotts25 属于效率类 Skill,可作为该场景下的辅助能力补充。

SKILL.md

name
mimotts25
description
小米大模型 MiMo TTS 2.5 语音合成。支持多种预设音色(中文/英文/默认)、风格控制(情感、方言、角色扮演、语速)、音频标签精细控制。Use when the user asks to convert text to speech, generate audio, read text aloud with a specific style/emotion/dialect, or create voice files.
metadata
{"openclaw":{"requires":{"env":["MIMO_API_KEY"]},"primaryEnv":"MIMO_API_KEY","emoji":"🎙️"}}

MiMo TTS 2.5.2 — 语音合成

小米大模型 MiMo TTS 2.5.2 版本,高质量中文/英文语音合成。

🆕 2.5.2 版本更新

新增音色

  • mimo_male - 男声音色
  • mimo_child - 童声音色
  • mimo_cantonese - 粤语音色
  • mimo_sichuan - 四川话语音

新增音频格式

  • mp3 - 更小的文件大小,适合网络传输
  • ogg - 更好的兼容性,开源格式

优化功能

  • ✅ 重试机制:自动处理API限流
  • ✅ 改进错误处理:更详细的错误信息
  • ✅ 超时设置:避免长时间等待

首次配置

⚠️ TTS 的 API Key 独立于模型推理 Key。 即使 mimo-v2-pro 能正常调用,TTS 仍需单独配置 Key。

  1. 前往小米 MiMo 开放平台获取 TTS API Key:https://api.xiaomimimo.com
  2. 通过 OpenClaw 配置:
openclaw config set skills.entries.mimotts25.apiKey "your-tts-api-key-here"

或直接设置环境变量 MIMO_API_KEY。 配置后需重启会话。

故障排查

错误原因解决
401 Invalid API KeyAPI Key 未传入或格式不对确认已用 config set 配置 TTS 专用 Key,重启会话
工具调用被 abort上下文过长或系统繁忙等几秒后重试

生成语音

使用 scripts/tts.py 合成语音:

python3 "{baseDir}/scripts/tts.py" "要合成的文本" -o output.wav

参数说明

参数默认值说明
-ooutput.wav输出文件路径
-vmimo_default音色:mimo_defaultdefault_zhdefault_enmimo_malemimo_childmimo_cantonesemimo_sichuan
-s风格标签,如 开心东北话悄悄话孙悟空
-fwav音频格式:wavmp3ogg
--user-msg可选的用户角色上下文,用于调整语气
--api-key环境变量 MIMO_API_KEYAPI Key 覆盖
--max-retries3API调用最大重试次数
--list-voices列出所有可用音色
--list-formats列出所有可用音频格式

使用示例

# 基础合成
python3 "{baseDir}/scripts/tts.py" "你好,今天天气真好" -o hello.wav

# 方言风格
python3 "{baseDir}/scripts/tts.py" "哎呀妈呀,这天儿也忒冷了吧" -s "东北话" -o dongbei.wav

# 英文音色
python3 "{baseDir}/scripts/tts.py" "Hello, how are you today?" -v default_en -o hello_en.wav

# 情感 + 语速
python3 "{baseDir}/scripts/tts.py" "明天就是周五了,真开心!" -s "开心 变快" -o happy.wav

# 唱歌
python3 "{baseDir}/scripts/tts.py" "一闪一闪亮晶晶" -s "唱歌" -o sing.wav

# 🆕 2.5.2 新功能示例

# 男声音色
python3 "{baseDir}/scripts/tts.py" "大家好,我是你们的主持人" -v mimo_male -o male.wav

# 童声音色
python3 "{baseDir}/scripts/tts.py" "妈妈,我想吃糖" -v mimo_child -o child.wav

# 粤语
python3 "{baseDir}/scripts/tts.py" "你好,今日天气好好" -v mimo_cantonese -o cantonese.wav

# 四川话
python3 "{baseDir}/scripts/tts.py" "这个火锅巴适得很" -v mimo_sichuan -o sichuan.wav

# MP3格式(更小的文件)
python3 "{baseDir}/scripts/tts.py" "今天心情不错" -f mp3 -o output.mp3

# OGG格式(开源格式)
python3 "{baseDir}/scripts/tts.py" "测试音频" -f ogg -o output.ogg

# 列出所有可用音色
python3 "{baseDir}/scripts/tts.py" --list-voices

# 列出所有可用音频格式
python3 "{baseDir}/scripts/tts.py" --list-formats

风格与音频标签

  • 在文本开头使用 <style>风格</style> 设置整体风格
  • 行内音频标签精细控制:(紧张)(小声)(语速加快)(深呼吸)(苦笑)(沉默片刻)
  • 多风格组合:<style>开心 变快</style>文本内容

🆕 2.5.2 新增风格标签

  • (停顿) - 自然停顿
  • (叹气) - 叹气声
  • (笑声) - 轻笑
  • (清嗓子) - 清嗓子声音
  • (耳语) - 耳语效果

音色列表

名称voice 参数
MiMo-默认mimo_default
MiMo-中文女声default_zh
MiMo-英文女声default_en
MiMo-男声mimo_male
MiMo-童声mimo_child
MiMo-粤语mimo_cantonese
MiMo-四川话mimo_sichuan

参考风格

风格适用场景
可爱撒娇、软萌
开心欢快、兴奋
东北话方言、搞笑
悄悄话神秘、低语
孙悟空角色扮演
唱歌儿歌、旋律
变快 / 变慢语速控制
🆕 悲伤悲伤、失落
🆕 愤怒愤怒、激动
🆕 平静平静、舒缓
🆕 惊讶惊讶、意外
可自由组合开心 变快可爱 悄悄话悲伤 变慢

交付

生成音频后,用 MEDIA: 指令交付给用户:

MEDIA:output.wav

📋 版本历史

v2.5.2 (2026-04-23)

  • ✨ 新增4种音色:男声、童声、粤语、四川话
  • ✨ 新增音频格式:mp3、ogg
  • ✨ 新增重试机制,自动处理API限流
  • ✨ 改进错误处理,提供更详细的错误信息
  • ✨ 新增风格标签:停顿、叹气、笑声、清嗓子、耳语
  • ✨ 新增情感风格:悲伤、愤怒、平静、惊讶
  • ✨ 新增命令行参数:--list-voices、--list-formats
  • ✨ 新增max-retries参数,可配置重试次数

v2.5.1

  • 🐛 修复了一些已知问题
  • 🚀 性能优化

v2.5.0

  • 🎉 初始版本
  • ✨ 支持3种基础音色
  • ✨ 支持风格控制和音频标签
  • ✨ 支持wav格式

适合场景

01

OpenClaw 用户查找和安装 Skill 时

02

用户想查找某类 Agent Skill 时

03

需要根据任务场景推荐可安装能力包时

04

需要对比不同来源的安装命令和来源信息时

能力概览

能力 1

按任务关键词查找相关 Skills

能力 2

展示可复制的安装命令

能力 3

保留来源站点、仓库和原始说明,方便继续核验

能力 4

补充不同宿主或平台的使用分布数据

能力 5

展示第三方安全扫描或审计结果

安装后应在对应宿主中按原始 README 的触发条件使用;具体调用方式请以来源页面和 README 为准。

平台分布

OpenClaw

77.7%
按下载量换算1,050

安全审计

VirusTotal

通过

ClawScan

通过

Static analysis

通过

权限和风险

敏感数据

该 Skill 可能接触密钥、Token、环境变量或敏感配置,应进入高风险复核队列,默认不自动发布。

安装前确认

本站仅展示第三方公开信息,不托管安装包,不提供自动安装或运行环境。安装前应自行审查源码、依赖和命令行为。当前只有一个来源,正式发布前建议补源仓库或其他目录站核验。

来源信息

继续浏览同类 Skills