Token导航 LogoToken导航TokenDH.com
效率敏感数据clawhub未标认证来源可访问clear审计提醒

xiaomi-mimo-v2-tts小米 mimo v2 tts

Agent Skill

xiaomi-mimo-v2-tts 用于补充效率相关能力,适合在 OpenClaw 中需要让 Agent 承接效率相关任务时使用。可结合来源仓库、安装命令和原始 README 继续核验具体用法。安装前建议确认权限范围、维护状态,以及是否会触发联网、命令执行或文件读写。

总安装

3,420

周安装

137

GitHub Stars

1

下载量

1,107
OpenClaw

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

GitHub

来源数

2

许可证

MIT-0

最后核验

2026-05-01

来源状态

来源可访问

安装方式

通过对话安装

复制提示词发给支持本地命令或 Skills 的 AI 助手,先确认命令和权限,再让它执行。

请帮我安装这个 Agent Skill:xiaomi-mimo-v2-tts(小米 mimo v2 tts)
来源仓库:https://github.com/php737/xiaomi-mimo-v2-tts
安装命令:
openclaw skills install xiaomi-mimo-v2-tts
安装前请先检查当前环境是否支持对应 CLI,并向我确认将要执行的命令、安装目录、联网范围和文件读写权限;确认后再执行。

命令行安装

复制命令到本机终端执行。该命令会通过 OpenClaw 从第三方来源获取 Skill;本站只展示命令,不托管安装包,也不自动执行。

ClawHubOpenClaw
openclaw skills install xiaomi-mimo-v2-tts

简介

小米 MiMo V2 TTS 提供免费中文英文语音合成服务。

  • 内置情感风格、角色扮演与方言变体,增强表达多样性。
  • 支持语速调节与唱歌模式,mp3/opus 可直接发送微信飞书。
  • 必须在 openclaw.json 中配置 API 密钥才能启用该技能。
  • 免费额度有限,高频使用建议申请正式商业授权。xiaomi-mimo-v2-tts 属于效率类 Skill,可作为该场景下的辅助能力补充。

SKILL.md

name
Xiaomi-MiMo-V2-TTS
version
2.0.0
description
|
category
audio-generation
tags

🎙️ MiMo TTS — 快速上手

小米 MiMo V2 TTS 语音合成,支持中文、英文及多种风格(情感、方言、角色扮演等)。

⚡ 快速开始

# 安装依赖
pip install requests && apt install ffmpeg

# 配置 API Key(在 openclaw.json 中添加)
# "skills.entries.Xiaomi-MiMo-V2-TTS.env.MIMO_API_KEY": "your-key"

# 合成语音
python3 /root/.openclaw/skills/mimo-tts/scripts/tts.py --text "你好,世界!" --output hello.wav

📌 必知参数

参数必填说明
--text要合成的文字(单条模式)
--batch批量模式:文本文件路径(每行一条)
--output输出路径,默认 output.wav
--format输出格式:wav(默认) / mp3 / pcm16 / opus

🎨 风格与音色

音色

voice 参数说明
mimo_defaultMiMo-默认
default_zh中文女声
default_en英文女声

风格控制

💡 格式:<style>风格1 风格2</style>待合成内容(风格标签放文字开头
类型可用风格
语速变快、变慢
情绪开心、悲伤、生气
方言东北话、四川话、河南话、粤语
角色孙悟空、林黛玉
风格悄悄话、夹子音、台湾腔
其他唱歌、叙事、讲故事
⚠️ 唱歌必须在文本最开头加 <style>唱歌</style>

🎭 音频标签(细粒度控制)

在文本中插入音频标签,可精准控制停顿、呼吸、语速变化等:

(紧张,深呼吸)呼……冷静,冷静。不就是一个面试吗……(语速加快,碎碎念)
(极其疲惫,有气无力)师傅……到地方了叫我一声……
(提高音量喊话)大姐!这鱼新鲜着呢!

💬 常用示例

# 情感风格
python3 tts.py --text "明天就是周五了,真开心!" --style 开心 --output happy.wav

# 角色扮演
python3 tts.py --text "俺老孙来也!" --style 孙悟空 --output wukong.wav

# 方言
python3 tts.py --text "哎呀妈呀,这天儿也太冷了!" --style 东北话 --output dongbei.wav

# 英文
python3 tts.py --text "Hello world!" --voice default_en --output hello_en.wav

# 唱歌(必须加 <style>唱歌</style>)
python3 tts.py --text "<style>唱歌</style>原谅我这一生不羁放纵爱自由" --output song.wav

# 发微信/飞书 → 用 mp3 或 opus 格式
python3 tts.py --text "你好呀" --format opus --output hello.opus

# 多风格组合
python3 tts.py --text "好开心呀" --style "开心 四川话" --output happy_sichuan.opus

# 批量合成
python3 tts.py --batch texts.txt --output-dir ./voices --format opus

📋 参数完整列表

参数说明默认值
--text要合成的文字
--batch批量模式:文本文件路径
--output输出文件路径output.wav
--output-dir输出目录(批量模式)./voices
--voice音色mimo_default
--style语音风格(可多次指定组合)
--format输出格式wav
--user-text用户侧消息(辅助上下文)

❌ 常见问题

问题解决
未设置 MIMO_API_KEYopenclaw.jsonskills.entries.Xiaomi-MiMo-V2-TTS.env 中配置
API 返回异常Key 无效或过期
ImportError: requestspip install requests
ffmpeg 未安装apt install ffmpeg
唱歌风格无效必须加 <style>唱歌</style> 在文本最开头

🔧 技术细节

  • 模型:mimo-v2-tts
  • APIhttps://api.xiaomimimo.com/v1/chat/completions
  • 采样率:24kHz
  • 自动重试:失败自动重试 3 次(间隔 2 秒)
  • 风格标签 <style>风格</style> 放在文字开头

适合场景

01

OpenClaw 用户查找和安装 Skill 时

02

用户想查找某类 Agent Skill 时

03

需要根据任务场景推荐可安装能力包时

04

需要对比不同来源的安装命令和来源信息时

能力概览

能力 1

按任务关键词查找相关 Skills

能力 2

展示可复制的安装命令

能力 3

保留来源站点、仓库和原始说明,方便继续核验

能力 4

补充不同宿主或平台的使用分布数据

能力 5

展示第三方安全扫描或审计结果

安装后应在对应宿主中按原始 README 的触发条件使用;具体调用方式请以来源页面和 README 为准。

平台分布

OpenClaw

77.39%
按下载量换算857

安全审计

VirusTotal

通过

ClawScan

可疑

Static analysis

通过

权限和风险

敏感数据

该 Skill 可能接触密钥、Token、环境变量或敏感配置,应进入高风险复核队列,默认不自动发布。

安装前确认

本站仅展示第三方公开信息,不托管安装包,不提供自动安装或运行环境。安装前应自行审查源码、依赖和命令行为。来源安全扫描存在 warning/failed 结果,不能写成本站确认安全。当前只有一个来源,正式发布前建议补源仓库或其他目录站核验。

来源信息

继续浏览同类 Skills