Token导航 LogoToken导航TokenDH.com
效率需要联网clawhub未标认证来源可访问clear审计提醒

funasr-asr富纳斯尔阿瑟尔

Agent Skill

funasr-asr 用于补充效率相关能力,适合在 OpenClaw 中需要让 Agent 承接效率相关任务时使用。可结合来源仓库、安装命令和原始 README 继续核验具体用法。安装前建议确认权限范围、维护状态,以及是否会触发联网、命令执行或文件读写。

总安装

5,328

周安装

222

GitHub Stars

1

下载量

1,776
OpenClaw

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

GitHub

来源数

2

许可证

MIT-0

最后核验

2026-05-01

来源状态

来源可访问

安装方式

通过对话安装

复制提示词发给支持本地命令或 Skills 的 AI 助手,先确认命令和权限,再让它执行。

请帮我安装这个 Agent Skill:funasr-asr(富纳斯尔阿瑟尔)
来源仓库:https://github.com/ruitao/funasr-asr
安装命令:
openclaw skills install funasr-asr
安装前请先检查当前环境是否支持对应 CLI,并向我确认将要执行的命令、安装目录、联网范围和文件读写权限;确认后再执行。

命令行安装

复制命令到本机终端执行。该命令会通过 OpenClaw 从第三方来源获取 Skill;本站只展示命令,不托管安装包,也不自动执行。

ClawHubOpenClaw
openclaw skills install funasr-asr

简介

本地中文语音识别,使用阿里达摩院 FunASR。触发场景:(1) 用户发送语音消息需转录,(2) 需要转录音频/视频文件,(3) 从网页下载视频并转录,(4) 中文语音转文字任务。支持小内存模式(~500MB)和大模型模式(~2GB),自动内存管理,任务队列防并行。

SKILL.md

name
funasr-asr
description
Local speech recognition using Alibaba DAMO Academy's FunASR. Triggers: (1) user sends voice message requiring transcription, (2) need to transcribe audio/video files, (3) download video from web and transcribe, (4) speech-to-text tasks. Default SenseVoiceSmall model (~500MB), single-process segmented transcription for memory efficiency. Multilingual: Chinese, English, Japanese, Korean, Cantonese.

FunASR 本地语音识别

阿里达摩院开源 ASR,完全本地部署,内存优化版。

快速使用

命令行

# 默认 small 模式(SenseVoiceSmall, ~500MB)
python3 scripts/transcribe.py /path/to/audio.wav

# 大模型模式(Paraformer-Large, ~2GB,中文极高精度)
python3 scripts/transcribe.py /path/to/audio.wav --mode large

# 自定义分段时长(默认 600 秒 = 10 分钟)
python3 scripts/transcribe.py /path/to/audio.wav --segment 300

# JSON 输出
python3 scripts/transcribe.py /path/to/audio.wav --format json

# 转录视频文件
python3 scripts/video-transcribe.py --audio /path/to/video.mp4

Node.js 调用

const funasr = require('./index.js');

const text = await funasr.transcribe('/path/to/audio.wav', {
  mode: 'small',    // 'small' 或 'large'
  format: 'text'    // 'text' 或 'json'
});

核心优化(v2.0)

优化项旧方案新方案
进程模型每段新进程单进程,模型加载一次
默认模型paraformer (~2GB)SenseVoiceSmall (~500MB)
内存峰值~2GB × N 次~500MB 常驻
段间释放进程退出gc.collect()
任务锁✅ 保留

模式对比

特性small (默认)large
模型SenseVoiceSmallParaformer-Large
内存~500MB~2GB
语言中英日韩粤中文
精度极高
速度快 (~0.1 RTF)较慢 (~0.3 RTF)
适用场景日常转录专业中文场景

安装

# Python 依赖
pip install funasr onnxruntime psutil

# 视频处理(可选)
pip install yt-dlp
apt install ffmpeg

# 首次运行自动下载模型
# small: ~500MB | large: ~2GB

支持格式

  • 音频: WAV, MP3, FLAC, M4A(自动转 16kHz mono)
  • 视频: MP4, WebM, AVI, MOV

故障排查

问题解决
模型下载失败pip install modelscope && modelscope download --model iic/SenseVoiceSmall
内存不足 (OOM)--mode small --segment 300 减小分段
音频格式错误ffmpeg -i input.mp3 -ar 16000 -ac 1 output.wav
转录有奇怪标记脚本自动清理 `<en>` 等 SenseVoice 标记

许可证

MIT License

适合场景

01

OpenClaw 用户查找和安装 Skill 时

02

用户想查找某类 Agent Skill 时

03

需要根据任务场景推荐可安装能力包时

04

需要对比不同来源的安装命令和来源信息时

能力概览

能力 1

按任务关键词查找相关 Skills

能力 2

展示可复制的安装命令

能力 3

保留来源站点、仓库和原始说明,方便继续核验

能力 4

补充不同宿主或平台的使用分布数据

能力 5

展示第三方安全扫描或审计结果

安装后应在对应宿主中按原始 README 的触发条件使用;具体调用方式请以来源页面和 README 为准。

平台分布

OpenClaw

97.02%
按下载量换算1,723

安全审计

VirusTotal

可疑

ClawScan

通过

Static analysis

可疑

权限和风险

需要联网

该 Skill 可能需要联网访问来源站点、仓库或外部 API;具体网络访问范围需要结合源码和 README 复核。

安装前确认

本站仅展示第三方公开信息,不托管安装包,不提供自动安装或运行环境。安装前应自行审查源码、依赖和命令行为。来源安全扫描存在 warning/failed 结果,不能写成本站确认安全。当前只有一个来源,正式发布前建议补源仓库或其他目录站核验。

来源信息

继续浏览同类 Skills