Token导航 LogoToken导航TokenDH.com
运维敏感数据clawhub未标认证来源可访问clear审计提醒

deepsop-voice-cloneDeepsop 语音克隆

Agent Skill

用于辅助音频、音乐、语音转写、语音合成或声音素材处理。它适合让 Agent 生成配乐说明、整理音频流程、调用语音工具或处理播客和视频配音素材。使用时需要确认输入音频来源、输出格式、时长和模型限制;涉及人声克隆、版权音乐或公开发布时,应先核对授权和合规边界。

总安装

3,892

周安装

159

GitHub Stars

公开资料未说明

下载量

1,259
OpenClaw

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

GitHub

来源数

2

许可证

MIT-0

最后核验

2026-05-01

来源状态

来源可访问

安装方式

通过对话安装

复制提示词发给支持本地命令或 Skills 的 AI 助手,先确认命令和权限,再让它执行。

请帮我安装这个 Agent Skill:deepsop-voice-clone(Deepsop 语音克隆)
来源仓库:https://github.com/2393970875/deepsop-voice-clone
安装命令:
openclaw skills install deepsop-voice-clone
安装前请先检查当前环境是否支持对应 CLI,并向我确认将要执行的命令、安装目录、联网范围和文件读写权限;确认后再执行。

命令行安装

复制命令到本机终端执行。该命令会通过 OpenClaw 从第三方来源获取 Skill;本站只展示命令,不托管安装包,也不自动执行。

ClawHubOpenClaw
openclaw skills install deepsop-voice-clone

简介

使用 AI Artist API 实现音色克隆与语音合成功能。

  • 适用于配音、播客制作或个性化语音交互开发。
  • 需上传音频样本创建音色库并设置有效 API Token。
  • 涉及人声使用时须遵守隐私与版权规定。deepsop-voice-clone 属于运维类 Skill,可作为该场景下的辅助能力补充。
  • 建议核查输出音质与适用场景后再正式应用。

SKILL.md

name
voice-clone
description
|

Voice Clone - 声音复刻技能

使用 AI Artist API 进行音色克隆和语音合成的完整解决方案。基于 CosyVoice v3.5 Plus 模型,支持高质量的音色复刻和文本转语音。

🎯 技能概述

本技能提供三大核心功能:

功能说明典型场景
查询音色列出系统中所有可用音色查看已有音色库,选择合适的声音
音色克隆上传音频创建新的音色复刻自己的声音、领导的声音、明星声音等
语音合成使用指定音色生成语音用特定声音朗读文本、生成配音、制作语音消息

⚠️ 首次使用必读

1. 获取 API Key

访问 https://ai.deepsop.com/ 注册并登录,然后在控制台创建你的 API Key。

2. 设置环境变量

在使用前,你必须先设置自己的 API Key:

# Windows PowerShell
$env:AI_ARTIST_TOKEN="sk-your_api_key_here"

# Linux/macOS/Git Bash (Windows)
export AI_ARTIST_TOKEN="sk-your_api_key_here"

3. 验证配置

python scripts/voice_clone.py --list

如果看到音色列表,说明配置成功!

🚀 快速开始

基础用法

# 1. 列出所有可用音色
python scripts/voice_clone.py --list

# 2. 使用音色 ID 合成语音
python scripts/voice_clone.py --synthesize --id 10 --text "大家好,我是测试语音"

# 3. 使用音色名称合成语音
python scripts/voice_clone.py --synthesize --name "蔡总的音色" --text "你好世界"

# 4. 下载合成的音频到本地
python scripts/voice_clone.py --synthesize --id 10 --text "你好" --download

创建新音色

# 使用本地音频文件创建音色
python scripts/voice_clone.py --create --name "我的音色" --audio "./my_voice.mp3"

# 使用在线音频 URL 创建音色
python scripts/voice_clone.py --create --name "我的音色" --audio-url "https://example.com/voice.mp3"

# 指定音色前缀
python scripts/voice_clone.py --create --name "客服音色" --audio "./cs.mp3" --prefix "CustomerService"

📋 详细使用指南

一、查询可用音色

列出系统中所有音色及其状态:

python scripts/voice_clone.py --list

输出示例:

[INFO] 共有 4 个音色

可用音色列表:
  [13] 王俏的音色 [OK] - cosyvoice-v3.5-plus
  [12] 测试 11 [OK] - cosyvoice-v3.5-plus
  [10] 蔡总的音色 [OK] - cosyvoice-v3.5-plus
  [4] 测试音色 [OK] - cosyvoice-v3.5-plus

状态说明:

状态说明是否可用
OK音色已就绪✅ 可用
DEPLOYING音色部署中❌ 暂不可用
其他音色异常❌ 不可用

二、语音合成

方式 1:使用音色 ID

python scripts/voice_clone.py --synthesize --id 13 --text "真正重要的东西,用眼睛是看不见的,只有用心才能看清。"

方式 2:使用音色名称

python scripts/voice_clone.py --synthesize --name "王俏的音色" --text "你好,欢迎使用库阔 AI"

方式 3:合成并下载

# 下载到默认目录 (~/.openclaw/workspace/audio/)
python scripts/voice_clone.py --synthesize --id 13 --text "测试语音" --download

# 下载到指定目录
python scripts/voice_clone.py --synthesize --id 13 --text "测试语音" --download --output-dir "./my_audio"

三、创建新音色

从本地音频文件创建

# 支持 MP3、WAV 等常见格式
python scripts/voice_clone.py --create --name "我的声音" --audio "./my_voice.mp3"

# 使用完整路径
python scripts/voice_clone.py --create --name "领导音色" --audio "C:\Users\admin\Downloads\leader_voice.wav"

从在线 URL 创建

python scripts/voice_clone.py --create --name "网络音色" --audio-url "https://example.com/voice.mp3"

指定音色前缀

python scripts/voice_clone.py --create --name "客服小王" --audio "./wang.mp3" --prefix "CustomerService"

🎙️ 音色克隆最佳实践

音频素材要求

要求说明
格式MP3、WAV、M4A 等常见音频格式
时长10-60 秒(推荐 30 秒左右)
音质清晰的人声,无明显背景噪音
内容纯人声朗读,无背景音乐
采样率16kHz 或以上

录制建议

  1. 环境安静 - 选择安静的房间,关闭空调、风扇等噪音源
  2. 距离适中 - 麦克风距离嘴巴 10-15 厘米
  3. 语速均匀 - 用正常语速朗读,不要过快或过慢
  4. 情感自然 - 用自然的情感朗读,不要过于夸张
  5. 内容多样 - 包含不同的音调、韵律,有助于模型学习

推荐的录音文本

你好,我是 XXX。这是一段用于音色克隆的录音样本。
我希望用我的声音来生成各种语音内容,包括问候语、通知、
故事朗读等。请确保录音清晰,语速适中,情感自然。
谢谢你的配合。

📊 参数说明

全局参数

参数必填说明
--list三选一列出所有可用音色
--synthesize三选一语音合成模式
--create三选一创建新音色模式

合成模式参数

参数必填说明示例
--id与 --name 二选一音色 ID--id 13
--name与 --id 二选一音色名称--name "王俏的音色"
--text要合成的文本--text "你好世界"
--download下载音频到本地--download
--output-dir音频保存目录--output-dir "./audio"

创建音色参数

参数必填说明示例
--name音色名称--name "我的音色"
--audio与 --audio-url 二选一本地音频路径--audio "./voice.mp3"
--audio-url与 --audio 二选一在线音频 URL--audio-url "https://..."
--prefix音色前缀--prefix "DeepSop"

🔧 环境配置

方式 1:临时设置(当前终端有效)

# Windows PowerShell
$env:AI_ARTIST_TOKEN="sk-5c6c262755dc43d59ec5a742a7e80202"

# Linux/macOS
export AI_ARTIST_TOKEN="sk-5c6c262755dc43d59ec5a742a7e80202"

方式 2:永久设置(推荐)

创建 .env 文件(在脚本同目录或技能根目录):

AI_ARTIST_TOKEN=sk-your_api_key_here

方式 3:系统环境变量

Windows:

[System.Environment]::SetEnvironmentVariable('AI_ARTIST_TOKEN', 'sk-your_api_key_here', 'User')

Linux/macOS:

echo 'export AI_ARTIST_TOKEN="sk-your_api_key_here"' >> ~/.bashrc
source ~/.bashrc

💡 实用场景示例

场景 1:用特定音色发送语音消息

# 用蔡总的音色发送通知
python scripts/voice_clone.py --synthesize --name "蔡总的音色" \
  --text "各位同事,下午三点在会议室召开周会,请准时参加。" --download

场景 2:批量生成语音

# 生成多个语音片段
python scripts/voice_clone.py --synthesize --id 13 --text "第一章:开始" --download --output-dir "./audiobook/ch1"
python scripts/voice_clone.py --synthesize --id 13 --text "第二章:发展" --download --output-dir "./audiobook/ch2"
python scripts/voice_clone.py --synthesize --id 13 --text "第三章:高潮" --download --output-dir "./audiobook/ch3"

场景 3:创建多人音色库

# 为团队创建音色库
python scripts/voice_clone.py --create --name "客服小王" --audio "./wang.mp3"
python scripts/voice_clone.py --create --name "客服小李" --audio "./li.mp3"
python scripts/voice_clone.py --create --name "客服小张" --audio "./zhang.mp3"

# 查看音色列表
python scripts/voice_clone.py --list

场景 4:语音消息回复

# 收到语音后,用相同音色回复
# 1. 从语音消息提取音频
# 2. 创建音色(如果不存在)
python scripts/voice_clone.py --create --name "用户音色" --audio "./user_voice.wav"
# 3. 用该音色合成回复
python scripts/voice_clone.py --synthesize --name "用户音色" --text "收到,我会尽快处理。" --download

⚠️ 注意事项

必须遵守

  1. API Key 安全

- 不要将 API Key 提交到代码仓库 - 使用 .env 文件时加入 .gitignore - 定期更换 API Key

  1. 音色状态检查

- 只有 status: "OK" 的音色可用于语音合成 - DEPLOYING 状态的音色需要等待部署完成

  1. 音频格式要求

- 上传的音频建议为 MP3 或 WAV 格式 - 时长 10-60 秒效果最佳 - 确保音频清晰,无明显噪音

  1. 文本长度限制

- 合成文本建议控制在 500 字以内 - 过长文本可能失败或效果不佳

性能优化

优化项建议
音频素材使用 30 秒左右的清晰录音
文本长度单次合成不超过 200 字
并发请求避免同时发起多个合成请求
错误处理检查返回状态码,失败时重试

🔍 故障排查

问题 1:提示 "未配置 API_ARTIST_TOKEN"

原因: 环境变量未设置

解决:

# Windows PowerShell
$env:AI_ARTIST_TOKEN="sk-your_api_key_here"

# 或创建 .env 文件
echo "AI_ARTIST_TOKEN=sk-your_api_key_here" > .env

问题 2:音色状态为 DEPLOYING

原因: 音色正在部署中

解决: 等待几分钟后重新查询状态

python scripts/voice_clone.py --list

问题 3:语音合成失败

可能原因:

  • 音色状态不是 OK
  • 文本过长
  • 网络问题

解决:

  1. 检查音色状态:python scripts/voice_clone.py --list
  2. 缩短文本长度
  3. 检查网络连接

问题 4:文件上传失败

可能原因:

  • 文件路径不正确
  • 文件格式不支持
  • 文件过大

解决:

  1. 确认文件路径正确(使用绝对路径)
  2. 转换为 MP3 或 WAV 格式
  3. 确保文件大小合理(< 10MB)

📁 相关文件

文件说明
scripts/voice_clone.py主脚本,包含所有功能实现
references/api.mdAPI 详细文档,包含接口说明
.env环境配置文件(需自行创建)

📚 API 接口速查

接口方法说明
/ai/voice/clone/listGET查询音色列表
/ai/voice/clone/sync/createPOST创建新音色
/ai/voice/clone/synthesizePOST语音合成
/system/fileUpload/uploadPOST文件上传

详细 API 文档请查看 references/api.md

🎯 后续扩展

本技能支持以下扩展场景:

  • 批量合成 - 循环调用合成接口生成多个语音文件
  • 音色管理 - 添加删除、重命名音色的功能
  • 音频处理 - 集成音频剪辑、合并功能
  • Web 界面 - 构建图形化操作界面
  • API 服务 - 封装为 REST API 供其他系统调用

_如有问题或建议,请联系技能维护者。_

适合场景

01

OpenClaw 用户查找和安装 Skill 时

02

用户想查找某类 Agent Skill 时

03

需要根据任务场景推荐可安装能力包时

04

需要对比不同来源的安装命令和来源信息时

能力概览

能力 1

按任务关键词查找相关 Skills

能力 2

展示可复制的安装命令

能力 3

保留来源站点、仓库和原始说明,方便继续核验

能力 4

补充不同宿主或平台的使用分布数据

能力 5

展示第三方安全扫描或审计结果

安装后应在对应宿主中按原始 README 的触发条件使用;具体调用方式请以来源页面和 README 为准。

平台分布

OpenClaw

84.08%
按下载量换算1,059

安全审计

VirusTotal

通过

ClawScan

可疑

Static analysis

通过

权限和风险

敏感数据

该 Skill 可能接触密钥、Token、环境变量或敏感配置,应进入高风险复核队列,默认不自动发布。

安装前确认

本站仅展示第三方公开信息,不托管安装包,不提供自动安装或运行环境。安装前应自行审查源码、依赖和命令行为。来源安全扫描存在 warning/failed 结果,不能写成本站确认安全。当前只有一个来源,正式发布前建议补源仓库或其他目录站核验。

来源信息

继续浏览同类 Skills