克劳德之声
语音记录、转录和笔记系统 克劳德代码.
AI第一第二脑语音接口,可实现:
- 语音笔记 -将想法直接发送到您的vault收件箱
- 语音命令 -向Claude说出提示,而不是打字
- 桌面音频捕获 -记录和转录会议、视频、播客
建筑
此仓库包含三个紧密集成的模块:
claude-voice/
├── mcp-server/ # MCP server providing voice tools to Claude Code
├── voice-tools/ # Shared bash utilities for audio/transcription
└── skills/ # Claude Code skills (user-facing /commands)特性
/voice_note
使用自动静音检测录制语音笔记并保存到vault收件箱。
- 自动检测静音(约1.5秒暂停停止录制)
- 用Whisper转录
- 保存到当前或指定的vault
- 自定义标题或基于时间戳的文件名
用途:
/voice_note # Record to current vault
/voice_note "bitcoin thoughts" # Custom title
/voice_note bruno2brain-v3 "daily log" # Specific vault/voice_prompt
向克劳德说出命令,而不是打字。
用途:
/voice_prompt
[Speak: "Create a new note about quantum computing"]
[Claude executes your spoken command]/listen_start & /listen_stop
录制桌面音频输出(扬声器/耳机),用于会议笔记、视频摘要等。
用途:
/listen_start # Start background recording
[... attend meeting, watch video ...]
/listen_stop # Stop, transcribe, summarize, save to inbox安装
先决条件
- Linux(建议使用Ubuntu/Debian)
- Python 3.8+
jq(sudo apt install jq)
其他所有内容(ffmpeg、portaudio、Whisper)都由安装程序处理。
一次性安装
git clone https://github.com/rabb1tpt/claude-voice.git
cd claude-voice
# Linux
./install.sh
# macOS
./install-macos.sh安装程序将:
- 检查并提供安装系统deps(
ffmpeg,portaudio等等) - 安装 耳语 用于转录(或检测现有安装)
- 设置MCP服务器Python venv
- Symlink技能
~/.claude/skills/ - 注册
voiceMCP服务器中~/.claude/settings.json(可在全球所有Claude Code会话中使用)
然后 重新启动克劳德代码 你准备好了。
macOS注意事项:/listen_start和/listen_stop需要PulseAudio,并且仅支持Linux。/voice_prompt和/voice_note在两个平台上工作。
用法
安装后,这些技能可以在任何Claude Code会话中使用:
/voice_note # Quick voice capture
/voice_prompt # Speak a command
/listen_start # Start recording desktop audio
/listen_stop # Stop and process recording或者自然地问——克劳德会在相关时自动调用技能:
- “录制有关此会议的语音备忘”
- “听听我要说什么,然后执行它”
音频源
- 语音笔记和提示:麦克风输入(自动静音检测)
- 聆听环节:桌面音频输出(通过PulseAudio环回的扬声器/耳机)
输出格式
语音备忘
# inbox/voice-{title}.md
[Transcription of your voice note]
#voice-note聆听环节
# inbox/listen-YYYY-MM-DD-HHMMSS.md
## Summary
[AI-generated summary of the audio]
## Full Transcript
[Complete transcription with timestamps]
#listen-session运作原理
- 技能 (
.md文件位于skills/)定义用户界面-哪些命令可用以及如何使用它们 - MCP服务器 (
mcp-server/server.py)提供实际工具(record_voice_note,listen)通过模型上下文协议连接到Claude代码 - 语音工具 (
voice-tools/)包含用于音频处理、转录和文件处理的共享bash实用程序
当你调用一项技能时,Claude Code:
- 加载技能说明
- 调用相应的MCP工具
- MCP服务器使用语音工具进行录音和转录
- 将结果返回给Claude进行处理
故障排除
“没有可用的MCP工具”
- 检查一下
.mcp.json存在于vault中,并指向正确的路径 - 验证Python venv是否已激活并安装了依赖项
- 重新启动Claude Code会话
“转录失败”
- 验证Whisper是否已在本地安装:
which whisper - 检查音频文件是否已创建(临时文件在
/tmp/) - 确保已安装ffmpeg:
which ffmpeg
桌面音频未录制
- 验证PulseAudio环回是否已配置
- 检查
pactl list sources用于监控设备 - 有关PulseAudio设置,请参阅语音工具README
哲学:人工智能第一大脑第二大脑
该系统代表了 AI优先的方法 个人知识管理:
传统PKM:类型→ 组织→ 搜索→ Read AI第一PKM:说话→ AI捕捉→ 会话检索
通过消除每一步的摩擦(语音与打字、人工智能组织与手动标记、对话与搜索),我们实现了:
- 以语速捕捉思想
- 灵感迸发时从事平行项目
- 无缝上下文切换,不中断流程
语音界面使第二大脑感觉像是思维的延伸,而不是你必须“使用”的单独工具
贡献
问题和PR欢迎!这是一个公开的个人工作流程工具——如果它能帮助你构建自己的人工智能优先系统,那就是目标。
许可证
MIT许可证-请参阅许可证文件
学分
由...建造 @rabb1tl0ka 作为bruno2brain-v3跳马系统的一部分。
技术支持:
