Token导航 LogoToken导航TokenDH.com
待分类需要联网github未标认证来源可访问许可证需确认审计提醒

byted-podcast-gen字节播客生成器

Agent Skill

byted-podcast-gen 用于处理 GitHub 仓库、Issue、Pull Request 和代码协作信息,适合在 Codex、Claude、Cursor、Gemini CLI 中需要围绕仓库状态、代码变更或协作事项进行整理时使用。可结合来源仓库、安装命令和原始 README 继续核验具体用法。安装前建议确认权限范围、维护状态,以及是否会触发联网、命令执行或文件读写。

总安装

324

周安装

13

GitHub Stars

325

下载量

105
CodexClaudeCursorGemini CLI

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

GitHub

来源数

2

许可证

unknown

最后核验

2026-05-01

来源状态

来源可访问

安装方式

通过对话安装

复制提示词发给支持本地命令或 Skills 的 AI 助手,先确认命令和权限,再让它执行。

请帮我安装这个 Agent Skill:byted-podcast-gen(字节播客生成器)
来源仓库:https://github.com/bytedance/agentkit-samples
仓库路径:skills/byted-podcast-gen
安装命令:
npx skills add https://github.com/bytedance/agentkit-samples --skill byted-podcast-gen
安装前请先检查当前环境是否支持对应 CLI,并向我确认将要执行的命令、安装目录、联网范围和文件读写权限;确认后再执行。

命令行安装

复制命令到本机终端执行。该命令会通过 npx skills 从第三方来源获取 Skill;本站只展示命令,不托管安装包,也不自动执行。

skills.shnpx skills
npx skills add https://github.com/bytedance/agentkit-samples --skill byted-podcast-gen

简介

将文本或网页内容合成为播客音频,支持分段文本输出。

  • 输入可为话题描述、URL 或文件地址(pdf/doc/txt)。
  • action=4 表示话题模式,action=0 配合 input_url 使用网页模式。
  • 必须验证下载链接可用性,不可用则仅返回本地生成文件。
  • 最终需提供完整音频链接与本地文件双选项供用户选择。

SKILL.md

Podcast Skill

基于火山引擎豆包语音合成 WebSocket 协议(PodcastTTS,/api/v3/sami/podcasttts)将某个话题合成为播客音频并保存为本地文件。支持:

  • 输入一句话题文本或者一个网页地址(也可以是个文件下载地址,支持 pdf/word/txt 格式)生成播客
  • 原样输出播客音频下载链接(不要做截断等处理)和生成好的本地文件供下载。验证下载链接是否可下载,若可下载则返回给用户,不可下载的只是只返回本地文件。
  • 输出播客分段文本(JSON)

适用场景

  1. 用户提到 生成播客播客合成 等相关关键词。
  2. 用户需要为某个话题生成播客形式的音频文件。
  3. 用户需要某个网页或文件内容生成播客形式的音频文件。
  4. 用户需要为用户上传的文件内容或者一个长上下文生成播客形式的音频文件。

强制规则(最高优先级)

当你收到用户请求生成播客时:

  • 必须且只能使用 本 Skill 的脚本来生成播客
  • 话题模式 用户需要为某个话题生成播客形式的音频文件, 使用参数 action=4prompt_text = 话题文本。
  • 网页模式 用户需要某个网页或可下载文件内容生成播客形式的音频文件, 使用参数 action=0input_url = 网页地址或文件下载地址。
  • 文件模式 用户需要为用户上传的文件内容或者一个长上下文生成播客形式的音频文件, 使用参数 action=0text = 用户上传文件读取出来的内容或者是一段比较长的文本,一般超过 200 个字。

使用步骤

  1. 分析用户需要合成播客的内容,准备要合成的输入:prompt_text(原始话题,一般不超过 20 个字)或 input_url(网页地址或文件下载地址) 或者 text(用户上传文件读取出来的内容或者是一个比较长的文本,一般超过 200 个字)。
  2. 运行脚本前先 cd 到本技能目录:skills/byted-podcast-gen
  3. 配置鉴权(环境变量或命令行参数)。
  4. 执行脚本:python scripts/podcast.py [参数]。参考下面示例部分。
  5. 根据脚本输出的 JSON 里的 audio_path / texts / audio_url 使用生成结果,如果有 audio_url 是一个带过期时间的 URL, 原封不动的返回给用户, audio_path 是本地文件路径, 可以给用户提供下载。

脚本参数

参数简写必填说明
--text输入原始长文本(action=0 时使用)
--input_url输入文本的 URL(action=0 时使用,二选一)
--prompt_text提示词文本(action=4 时必填)
--action播客类型:0(原始文本/URL)、4(prompt);默认 4
--speaker_info说话人配置 JSON(默认 {"random_order":false}
--encoding音频格式:mp3(默认)、wavogg_opus
--output最终音频输出文件路径(默认自动生成到 output/

返回值说明

脚本输出 JSON,包含:

  • status: "success""error"
  • task_id: 任务标识(用于定位一次生成任务)
  • audio_path: 最终音频本地路径
  • texts: 分段文本 JSON 字符串,每个发音人对应的文本列表。
  • audio_url: 服务端返回的音频下载地址
  • error: 失败时的错误信息

错误处理

  • 若报错提示缺少 MODEL_SPEECH_API_KEY:检查环境变量或命令行参数是否已配置,不存在的时候提示用户输入, 然后设置到环境变量。
  • 若收到服务端错误(MsgType.Error):根据错误信息检查账号权限、资源 ID、输入内容及是否已开通服务。
  • 若收到服务端错误包含关键字 quota 说明当前账号已超量,需升级火山引擎豆包语音的播客服务。
  • python 执行缺少相关 package 时,需要先安装依赖:pip install -r requirements.txt

参考文档

示例

# 基于话题生成播客音频
ptompt_text="豆包语音合成服务"
python scripts/podcast.py --prompt_text $ptompt_text --action 4
# 基于网页内容生成播客音频
url="https://www.volcengine.com/docs/6561/1668014?lang=zh"
python scripts/podcast.py --input_url $url --action 0
# 基于长文本内容生成播客音频
text="欢迎收听本期节目,我们聊聊人工智能的关键拐点……"
python scripts/podcast.py --text $text --action 0

适合场景

01

用户想查找某类 Agent Skill 时

02

需要根据任务场景推荐可安装能力包时

03

需要对比不同来源的安装命令和来源信息时

能力概览

能力 1

按任务关键词查找相关 Skills

能力 2

展示可复制的安装命令

能力 3

保留来源站点、仓库和原始说明,方便继续核验

能力 4

展示第三方安全扫描或审计结果

安装后应在对应宿主中按原始 README 的触发条件使用;具体调用方式请以来源页面和 README 为准。

平台分布

Codex

34.66%
按下载量换算36

Claude

30.4%
按下载量换算32

Cursor

17.54%
按下载量换算18

Gemini CLI

9.79%
按下载量换算10

安全审计

Gen Agent Trust Hub

通过

Socket

通过

Snyk

可疑

权限和风险

需要联网

该 Skill 可能需要联网访问来源站点、仓库或外部 API;具体网络访问范围需要结合源码和 README 复核。

安装前确认

本站仅展示第三方公开信息,不托管安装包,不提供自动安装或运行环境。安装前应自行审查源码、依赖和命令行为。来源安全扫描存在 warning/failed 结果,不能写成本站确认安全。当前只有一个来源,正式发布前建议补源仓库或其他目录站核验。

来源信息

继续浏览同类 Skills