Token导航 LogoToken导航TokenDH.com
效率敏感数据clawhub未标认证来源可访问clear审计通过

moss-tts-voice莫斯 tts 语音

Agent Skill

用于辅助音频、音乐、语音转写、语音合成或声音素材处理。它适合让 Agent 生成配乐说明、整理音频流程、调用语音工具或处理播客和视频配音素材。使用时需要确认输入音频来源、输出格式、时长和模型限制;涉及人声克隆、版权音乐或公开发布时,应先核对授权和合规边界。

总安装

35,350

周安装

1,430

GitHub Stars

7

下载量

11,097
OpenClaw

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

GitHub

来源数

2

许可证

MIT-0

最后核验

2026-05-01

来源状态

来源可访问

安装方式

通过对话安装

复制提示词发给支持本地命令或 Skills 的 AI 助手,先确认命令和权限,再让它执行。

请帮我安装这个 Agent Skill:moss-tts-voice(莫斯 tts 语音)
来源仓库:https://github.com/luogao2333/moss-tts-voice
安装命令:
openclaw skills install moss-tts-voice
安装前请先检查当前环境是否支持对应 CLI,并向我确认将要执行的命令、安装目录、联网范围和文件读写权限;确认后再执行。

命令行安装

复制命令到本机终端执行。该命令会通过 OpenClaw 从第三方来源获取 Skill;本站只展示命令,不托管安装包,也不自动执行。

ClawHubOpenClaw
openclaw skills install moss-tts-voice

简介

MOSS-TTS语音合成与音色克隆工具。生成适合各渠道的音频文件。 场景触发: - 用户要求生成语音、TTS - 用户提到“用我的声音”、“克隆声音”、“MOSS语音” - 需要生成语音文件用于发送 功能:文本转语音、实时克隆、预注册音色、多格式输出

SKILL.md

name
moss-tts-voice
description
|
metadata
openclaw
requires
env
bins
primaryEnv
MOSS_API_KEY
homepage
https://studio.mosi.cn
emoji
🎙️

MOSS-TTS 语音合成

⚠️ 注意:本工具负责生成音频文件,发送到各渠道需要配合其他工具(如 OpenClaw message 工具)

快速开始(3 步)

1. 获取 API Key

访问 https://studio.mosi.cn → 注册/登录 → 控制台 → API 密钥 → 创建

export MOSS_API_KEY="sk-你的密钥"

2. 安装依赖

# 系统依赖
brew install python3 ffmpeg

# Python 依赖
pip3 install requests

3. 生成语音

python3 scripts/tts.py \
  --text "你好,我是MOSS" \
  --channel feishu \
  --json

输出:

{
  "success": true,
  "file": "/tmp/openclaw/moss-tts/voice-xxx.ogg",
  "format": "ogg"
}

⚠️ 隐私与安全

API Key 安全

  • 不要提交到 Git:将 MOSS_API_KEY 添加到 .gitignore
  • 使用环境变量:不要在代码中硬编码密钥
  • 定期轮换:建议定期更换 API Key

语音数据上传

  • 克隆音色:上传的音频会存储在 MOSS Studio 服务器
  • 实时克隆:每次请求都会上传音频数据到 MOSS API
  • 数据保留:参考 MOSS Studio 隐私政策

建议

  • 使用公开/非敏感音频进行克隆
  • 避免上传包含敏感信息的录音
  • 定期清理 MOSS Studio 中不需要的音色

功能说明

本工具提供以下功能:

  1. 文本转语音 - 将文本转换为自然语音
  2. 实时克隆 - 从音频即时克隆声音
  3. 预注册音色 - 上传并保存音色供后续使用
  4. 格式转换 - 自动转换为适合各渠道的格式

不包含

  • 直接发送到 IM 渠道(需要配合其他工具)
  • 音色管理(删除、修改等)

使用模式

模式一:实时克隆

python3 scripts/tts.py \
  --text "要说的内容" \
  --reference_audio "参考音频.ogg" \
  --channel feishu

模式二:预注册音色(推荐)

# 1. 上传并克隆
curl -X POST https://studio.mosi.cn/api/v1/files/upload \
  -H "Authorization: Bearer $MOSS_API_KEY" \
  -F "file=@voice.ogg"
# → {"file_id": "YOUR_FILE_ID"}

curl -X POST https://studio.mosi.cn/api/v1/voice/clone \
  -H "Authorization: Bearer $MOSS_API_KEY" \
  -d '{"file_id": "YOUR_FILE_ID", "name": "我的声音"}'
# → {"voice_id": "YOUR_VOICE_ID"}

# 2. 使用(等待 10 秒后)
python3 scripts/tts.py \
  --text "你好" \
  --voice_id "YOUR_VOICE_ID" \
  --channel feishu

输出格式

渠道格式说明
feishuogg (opus)飞书语音消息格式
telegramogg (opus)Telegram 语音消息格式
whatsappogg (opus)WhatsApp 语音消息格式
discordmp3Discord 文件格式
signalmp3Signal 文件格式
slackmp3Slack 文件格式

参数说明

参数说明必填
--text待合成文本
--reference_audio参考音频(实时克隆)二选一
--voice_id预注册音色 ID二选一
--channel目标渠道
--format输出格式
--output输出路径
--jsonJSON 输出

音频要求

  • 格式: ogg, mp3, wav, m4a
  • 时长: 10-30 秒(推荐 20 秒以上)
  • 音质: 清晰人声,无背景噪音
  • 大小: < 10MB

常见问题

Q: 如何发送生成的语音?

本工具只生成音频文件。发送需要:

  1. 使用返回的文件路径
  2. 配合 OpenClaw message 工具或其他方式发送

Q: 飞书发送后是文件而不是语音?

确保音频格式正确:

file voice.ogg
# 应显示: Ogg data, Opus audio

Q: 克隆效果不好?

  • 时长 20 秒以上
  • 清晰人声,无噪音
  • 正常语速

API 端点

用途端点
文本转语音POST /v1/audio/tts
上传文件POST /api/v1/files/upload
克隆音色POST /api/v1/voice/clone
查询音色GET /api/v1/voices

详细文档


_版本: 1.2.0 | 更新: 2026-03-10_

适合场景

01

OpenClaw 用户查找和安装 Skill 时

02

用户想查找某类 Agent Skill 时

03

需要根据任务场景推荐可安装能力包时

04

需要对比不同来源的安装命令和来源信息时

能力概览

能力 1

按任务关键词查找相关 Skills

能力 2

展示可复制的安装命令

能力 3

保留来源站点、仓库和原始说明,方便继续核验

能力 4

补充不同宿主或平台的使用分布数据

能力 5

展示第三方安全扫描或审计结果

安装后应在对应宿主中按原始 README 的触发条件使用;具体调用方式请以来源页面和 README 为准。

平台分布

OpenClaw

79.81%
按下载量换算8,857

安全审计

VirusTotal

通过

ClawScan

通过

Static analysis

通过

权限和风险

敏感数据

该 Skill 可能接触密钥、Token、环境变量或敏感配置,应进入高风险复核队列,默认不自动发布。

安装前确认

本站仅展示第三方公开信息,不托管安装包,不提供自动安装或运行环境。安装前应自行审查源码、依赖和命令行为。当前只有一个来源,正式发布前建议补源仓库或其他目录站核验。

来源信息

继续浏览同类 Skills