Token导航 LogoToken导航TokenDH.com
效率敏感数据clawhub未标认证来源可访问clear审计提醒

volcano-engine-podcast火山引擎播客

Agent Skill

volcano-engine-podcast 用于补充效率相关能力,适合在 OpenClaw 中需要让 Agent 承接效率相关任务时使用。可结合来源仓库、安装命令和原始 README 继续核验具体用法。安装前建议确认权限范围、维护状态,以及是否会触发联网、命令执行或文件读写。

总安装

4,272

周安装

178

GitHub Stars

公开资料未说明

下载量

1,424
OpenClaw

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

GitHub

来源数

2

许可证

MIT-0

最后核验

2026-05-01

来源状态

来源可访问

安装方式

通过对话安装

复制提示词发给支持本地命令或 Skills 的 AI 助手,先确认命令和权限,再让它执行。

请帮我安装这个 Agent Skill:volcano-engine-podcast(火山引擎播客)
来源仓库:https://github.com/cindypapa/volcano-engine-podcast
安装命令:
openclaw skills install volcano-engine-podcast
安装前请先检查当前环境是否支持对应 CLI,并向我确认将要执行的命令、安装目录、联网范围和文件读写权限;确认后再执行。

命令行安装

复制命令到本机终端执行。该命令会通过 OpenClaw 从第三方来源获取 Skill;本站只展示命令,不托管安装包,也不自动执行。

ClawHubOpenClaw
openclaw skills install volcano-engine-podcast

简介

生成火山引擎豆包语音播客(PodcastTTS)。输入主题文本,自动生成双人对话式播客音频。

SKILL.md

name
volcano-engine-podcast
description
生成火山引擎豆包语音播客(PodcastTTS)。输入主题文本,自动生成双人对话式播客音频。
version
1.1.0
author
xiaohe
license
MIT
metadata
hermes
tags
[audio, podcast, tts, volcengine, doubao, 语音播客]

火山引擎豆包语音播客生成

基于火山引擎 PodcastTTS API,输入主题文本,AI 自动生成双人对话播客音频(含片头音乐、多轮对话、片尾结束)。

前提条件

  1. Python >= 3.9
  2. 安装 websockets>=14.0
  3. 火山引擎账号已开通 PodcastTTS 服务

快速开始

1. 环境变量配置(推荐)

export VOLC_APPID="your_appid"
export VOLC_ACCESS_TOKEN="your_access_token"
export VOLC_APP_KEY="your_app_key"  # 可选,默认 aGjiRDfUWi

2. 命令行调用

python scripts/generate_podcast.py "Hermes和OpenClaw怎么选"

3. Python 代码调用

import asyncio
from scripts.generate_podcast import PodcastGenerator

async def main():
    gen = PodcastGenerator(
        appid="3398567544",
        access_token="your_token",
    )
    result = await gen.generate(
        text="今天来聊聊AI编程助手",
        output_dir="./output",
        encoding="mp3",
        use_head_music=True,
    )
    print(result["final_files"])  # 输出音频路径列表

asyncio.run(main())

参数说明

PodcastGenerator 初始化参数

参数类型必填默认值说明
appidstr-应用 ID
access_tokenstr-Access Token
app_keystraGjiRDfUWiApp Key
resource_idstrvolc.service_type.10050资源 ID
endpointstrwss://openspeech...WebSocket 端点

generate() 方法参数

参数类型默认说明
textstr必填输入主题文本
output_dirstroutput输出目录
encodingstrmp3音频格式: mp3/wav/pcm
use_head_musicboolTrue是否加片头音乐
use_tail_musicboolFalse是否加片尾音乐
only_nlp_textboolFalse只生成文本不生成音频
return_audio_urlboolFalse返回音频URL而非流式
speaker_infodict{"random_order":False}说话人配置
speech_rateint0语速
skip_round_audio_saveboolFalse跳过分段保存
voice_typestrNone音色类型: zh_male / zh_female / multi
normalize_audioboolFalse是否对音频进行音量归一化
fade_in_outboolFalse是否添加淡入淡出效果

音色选择 (voice_type)

说明
None默认,AI 自动分配
zh_male中文男声
zh_female中文女声
multi多人对话模式

返回结果

{
    "success": True,
    "output_dir": "/abs/path/to/output",
    "segment_files": ["output/head_music_-1.mp3", "output/zh_female_0.mp3", ...],
    "final_files": ["output/podcast_final_1234567890.mp3"],
    "duration": 164.51,
    "texts": [
        {"text": "今天这期...", "speaker": "zh_female_mizaitongxue_v2_saturn_bigtts"},
        ...
    ],
    "usage": {"input_text_tokens": 0, "output_audio_tokens": 2800, "total_tokens": 2800}
}

CLI 参数

python scripts/generate_podcast.py "主题文本" \
    -o ./output \
    -f mp3 \
    --no-head-music \
    --tail-music \
    --only-text \
    --voice-type zh_female \
    --normalize \
    --fade \
    --appid YOUR_APPID \
    --token YOUR_TOKEN \
    -v

技术说明

  • 协议: 自定义二进制 WebSocket 协议(封装在 protocols.py 中)
  • 流式下发: 音频以 4~10KB 分片实时流式下发
  • 断点续传: 支持从中断轮次自动重试
  • 音频合并: 自动合并所有分段为完整音频
  • 音频后处理: 支持音量归一化(peak -1dB)和淡入淡出(0.5s)

注意事项

  1. Access Token 需从火山引擎控制台获取
  2. 每次调用消耗相应的 audio token
  3. 音频采样率固定为 24kHz
  4. 对话角色由 AI 自动分配(通常为一男一女双人对话)
  5. 音色选择 voice_type 为提示性参数,最终音色由服务端根据内容智能匹配

适合场景

01

OpenClaw 用户查找和安装 Skill 时

02

用户想查找某类 Agent Skill 时

03

需要根据任务场景推荐可安装能力包时

04

需要对比不同来源的安装命令和来源信息时

能力概览

能力 1

按任务关键词查找相关 Skills

能力 2

展示可复制的安装命令

能力 3

保留来源站点、仓库和原始说明,方便继续核验

能力 4

补充不同宿主或平台的使用分布数据

能力 5

展示第三方安全扫描或审计结果

安装后应在对应宿主中按原始 README 的触发条件使用;具体调用方式请以来源页面和 README 为准。

平台分布

OpenClaw

98.54%
按下载量换算1,403

安全审计

VirusTotal

通过

ClawScan

可疑

Static analysis

通过

权限和风险

敏感数据

该 Skill 可能接触密钥、Token、环境变量或敏感配置,应进入高风险复核队列,默认不自动发布。

安装前确认

本站仅展示第三方公开信息,不托管安装包,不提供自动安装或运行环境。安装前应自行审查源码、依赖和命令行为。来源安全扫描存在 warning/failed 结果,不能写成本站确认安全。当前只有一个来源,正式发布前建议补源仓库或其他目录站核验。

来源信息

继续浏览同类 Skills