Token导航 LogoToken导航TokenDH.com
开发权限需确认clawhub未标认证来源可访问clear审计通过

call-transcript-todo通话记录待办事项

Agent Skill

call-transcript-todo 用于处理音频、语音、转写和声音素材相关任务,适合在 OpenClaw 中需要整理音频流程、转写内容或生成配音素材时使用。可结合来源仓库、安装命令和原始 README 继续核验具体用法。安装前建议确认权限范围、维护状态,以及是否会触发联网、命令执行或文件读写。

总安装

2,752

周安装

117

GitHub Stars

公开资料未说明

下载量

964
OpenClaw

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

GitHub

来源数

2

许可证

MIT-0

最后核验

2026-05-01

来源状态

来源可访问

安装方式

通过对话安装

复制提示词发给支持本地命令或 Skills 的 AI 助手,先确认命令和权限,再让它执行。

请帮我安装这个 Agent Skill:call-transcript-todo(通话记录待办事项)
来源仓库:https://github.com/daaishu/call-transcript-todo
安装命令:
openclaw skills install call-transcript-todo
安装前请先检查当前环境是否支持对应 CLI,并向我确认将要执行的命令、安装目录、联网范围和文件读写权限;确认后再执行。

命令行安装

复制命令到本机终端执行。该命令会通过 OpenClaw 从第三方来源获取 Skill;本站只展示命令,不托管安装包,也不自动执行。

ClawHubOpenClaw
openclaw skills install call-transcript-todo

简介

自动转录音频文件为文字,并生成飞书文档包含实录、纪要与待办清单。

  • 适用于会议复盘、客户服务回访或培训素材整理等语音处理场景。
  • 支持多种音频格式输入,智能分段并提取关键行动项。
  • 依赖外部 ASR 服务,涉及用户语音数据上传,须确认脱敏策略合规。
  • 生成的待办会自动关联责任人与截止时间,便于后续任务分派。

SKILL.md

name
call-transcript-todo
description
|
env
FEISHU_APP_ID
required
false
description
飞书应用 App ID,用于创建飞书文档。未配置时输出为本地 Markdown 文件。
FEISHU_APP_SECRET
required
false
description
飞书应用 App Secret,与 FEISHU_APP_ID 配合使用。
dependencies
compatibility

通话录音转写

核心流程:转录音频 → 整理实录与纪要 → 提取待办 → 输出结果。


Step 1: 环境准备与转录

1.1 安装依赖

首次使用时安装(后续跳过):

pip install faster-whisper --break-system-packages 2>/dev/null || pip install faster-whisper
--break-system-packages 用于容器/沙箱环境。如果环境不允许,回退到不带此参数的安装。

1.2 音频转录

from faster_whisper import WhisperModel
import os

audio_path = '<音频文件路径>'

# 根据文件大小选择模型:< 5MB 用 small,否则用 medium
file_size_mb = os.path.getsize(audio_path) / (1024 * 1024)
model_size = 'small' if file_size_mb < 5 else 'medium'

try:
    model = WhisperModel(model_size, device='cpu', compute_type='int8')
    segments, info = model.transcribe(audio_path, language='zh')
    transcript = [seg.text for seg in segments]
    full_text = '\
'.join(transcript)
except Exception as e:
    # 转录失败时,告知用户具体原因并停止后续流程
    print(f"转录失败:{e}")
    # 常见原因:音频格式不支持、文件损坏、内存不足
    # 向用户说明错误并建议:检查文件格式、尝试转换为 mp3/wav 后重试
    raise

支持的音频格式:mp3, m4a, wav, ogg, amr, mp4, flac, webm

模型选择参考

  • small(~500MB):电话录音、短对话,速度快
  • medium(~1.5GB):会议录音、多人讨论、口音较重,准确率更高
  • 如果用户明确要求高精度,使用 medium

1.3 文件名信息提取

从文件名中尽量提取元数据:

文件名模式提取内容
XX_20260323.m4a来源:XX,日期:2026-03-23
Record_20260323_143022.mp3日期:2026-03-23 14:30
CallRecord_+8613912345678.m4a来源:+8613912345678
其他用文件名原文作为来源

Step 2: 整理实录与生成纪要

拿到转录原文后,做三层加工:

2.1 整理实录

将转录原文整理为可读的对话实录:

  • 根据语义和上下文判断说话人,标记为 [对方姓名/身份]
  • 合并同一说话人的连续短句
  • 修正明显的语音识别错误(专有名词、人名、机构名)
  • 格式:每段以 **我:****XX:** 开头

2.2 生成纪要

用连贯段落概括通话内容(3-5 句话),包含:

  • 通话背景:谁和谁、什么事由
  • 主要讨论内容和关键结论
  • 后续安排和跟进事项

纪要简洁精炼,不用列表格式。

2.3 提取待办

从通话内容中识别具体的待办事项:

  • 明确承诺要做的事
  • 约定的时间节点或截止日期
  • 需要跟进或确认的事项

如果没有明确的待办事项,标注"本次通话未提取到明确的待办事项。"


Step 3: 输出结果

根据环境配置选择输出方式。优先检测飞书凭证,有则输出飞书文档,无则输出本地文件。

3.1 输出内容模板

无论哪种输出方式,内容结构统一:

# 通话录音转写

**来源**:[从文件名提取,或标注"未知"]
**时间**:[YYYY-MM-DD HH:MM,无法提取则标注"未知"]
**时长**:[MM:SS,从转录 info 中获取]

---

## 实录

**我:** [说话内容]

**XX:** [说话内容]

...

---

## 纪要

[连贯段落,3-5句话]

---

## 待办

[待办事项,或"本次通话未提取到明确的待办事项。"]

3.2 飞书文档输出(需要凭证)

检测到 FEISHU_APP_IDFEISHU_APP_SECRET 环境变量时:

feishu_doc action=write

使用上述模板内容创建飞书文档,markdown 标题会自动转换为飞书文档标题格式。

不要用 update_block,必须用 action=write

输出失败时降级为本地文件输出(见 3.3)。

3.3 本地文件输出(默认/降级)

未配置飞书凭证,或飞书输出失败时:

将内容保存为 Markdown 文件,文件名格式:通话纪要_[来源]_[日期].md

# 示例路径
output/通话纪要_XX_20260323.md

Step 4: 发送结果与待办确认

4.1 发送结果

飞书输出成功时

📄 [飞书文档链接]

待办事项:
1. [待办内容]
2. [待办内容]

确认计入工作待办?(是/否/修改)

本地文件输出时

📄 已保存:通话纪要_XX_20260323.md

待办事项:
1. [待办内容]
2. [待办内容]

确认计入工作待办?(是/否/修改)

无待办时,只发文档/文件链接,附注"本次通话未提取到明确的待办事项。",不需要确认。

4.2 待办确认与写入

用户确认后才将待办写入 memory/todo.md(相对于当前工作目录):

  • "是" / "确认" / "OK" → 追加写入 todo.md,回复"已计入工作待办"
  • "否" / "不要" → 不写入,回复"已忽略"
  • 用户给出修改内容 → 按修改调整后再次确认

todo.md 格式

## [日期]

- [ ] [待办内容](来源:[通话来源])

未收到确认前,不写入 todo.md。


错误处理

场景处理方式
音频格式不支持告知用户,建议转换为 mp3/wav 后重试
转录结果为空或乱码提示音频质量可能不足,建议换 medium 模型重试
faster-whisper 安装失败提示用户检查 Python 环境和网络连接
飞书文档创建失败自动降级为本地 Markdown 文件输出,告知用户
模型下载超时提示首次使用需下载模型(small ~500MB),建议在网络稳定时重试

适合场景

01

OpenClaw 用户查找和安装 Skill 时

02

用户想查找某类 Agent Skill 时

03

需要根据任务场景推荐可安装能力包时

04

需要对比不同来源的安装命令和来源信息时

能力概览

能力 1

按任务关键词查找相关 Skills

能力 2

展示可复制的安装命令

能力 3

保留来源站点、仓库和原始说明,方便继续核验

能力 4

补充不同宿主或平台的使用分布数据

能力 5

展示第三方安全扫描或审计结果

安装后应在对应宿主中按原始 README 的触发条件使用;具体调用方式请以来源页面和 README 为准。

平台分布

OpenClaw

83.69%
按下载量换算807

安全审计

VirusTotal

未展示

ClawScan

通过

Static analysis

通过

权限和风险

权限需确认

当前来源未能明确判断权限范围,默认进入异常复核队列。

安装前确认

本站仅展示第三方公开信息,不托管安装包,不提供自动安装或运行环境。安装前应自行审查源码、依赖和命令行为。当前只有一个来源,正式发布前建议补源仓库或其他目录站核验。

来源信息

继续浏览同类 Skills