Token导航 LogoToken导航TokenDH.com
开发敏感数据clawhub未标认证来源可访问clear审计通过

step-asr步骤 ASR

Agent Skill

step-asr 用于处理音频、语音、转写和声音素材相关任务,适合在 OpenClaw 中需要整理音频流程、转写内容或生成配音素材时使用。可结合来源仓库、安装命令和原始 README 继续核验具体用法。安装前建议确认权限范围、维护状态,以及是否会触发联网、命令执行或文件读写。

总安装

10,137

周安装

431

GitHub Stars

1

下载量

3,551
OpenClaw

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

GitHub

来源数

2

许可证

MIT-0

最后核验

2026-05-01

来源状态

来源可访问

安装方式

通过对话安装

复制提示词发给支持本地命令或 Skills 的 AI 助手,先确认命令和权限,再让它执行。

请帮我安装这个 Agent Skill:step-asr(步骤 ASR)
来源仓库:https://github.com/randzero/step-asr
安装命令:
openclaw skills install step-asr
安装前请先检查当前环境是否支持对应 CLI,并向我确认将要执行的命令、安装目录、联网范围和文件读写权限;确认后再执行。

命令行安装

复制命令到本机终端执行。该命令会通过 OpenClaw 从第三方来源获取 Skill;本站只展示命令,不托管安装包,也不自动执行。

ClawHubOpenClaw
openclaw skills install step-asr

简介

通过 Step ASR 流 API 将音频文件实时转录为文本。

  • 支持中英文识别及 PCM、WAV、MP3、OGG/OPUS 等格式。
  • 适用于语音转写、会议记录或实时字幕生成等场景。
  • 需准备有效 API 密钥并确保音频质量符合模型要求。
  • 注意处理长音频时的分块策略与成本控制。step-asr 属于开发类 Skill,可作为该场景下的辅助能力补充。

SKILL.md

name
step-asr
description
Transcribe audio files to text via Step ASR streaming API (HTTP SSE). Supports Chinese and English, multiple audio formats (PCM, WAV, MP3, OGG/OPUS), real-time streaming output, and terminology correction prompts.
version
1.0.0
metadata
openclaw
emoji
\F399
requires
bins
env
primaryEnv
STEPFUN_API_KEY
homepage
https://platform.stepfun.com/docs/zh/api-reference/audio/asr-stream

Step ASR - Streaming Speech-to-Text

Transcribe audio files using the Step (StepFun) ASR API with HTTP SSE streaming.

Quick start

python3 {baseDir}/scripts/transcribe.py /path/to/audio.wav

Usage examples

Basic transcription (Chinese, streaming output):

python3 {baseDir}/scripts/transcribe.py /path/to/audio.wav

Specify language and save to file:

python3 {baseDir}/scripts/transcribe.py /path/to/audio.mp3 --language en --out /tmp/transcript.txt

Use a prompt for terminology correction:

python3 {baseDir}/scripts/transcribe.py /path/to/audio.pcm --prompt "Related terms: OpenClaw, StepFun, ASR"

Output as JSON (includes usage stats):

python3 {baseDir}/scripts/transcribe.py /path/to/audio.ogg --json

Non-streaming mode (only print final result):

python3 {baseDir}/scripts/transcribe.py /path/to/audio.wav --no-stream

Specify audio format explicitly (for raw PCM files without extension):

python3 {baseDir}/scripts/transcribe.py /path/to/raw_audio --format-type pcm --sample-rate 16000

Supported audio formats

FormatExtensionsNotes
PCM.pcm, .rawRaw PCM, default codec pcm_s16le
WAV.wavWAV container format
MP3.mp3
OGG/OPUS.ogg, .opus

All options

FlagDefaultDescription
--languagezhLanguage code (zh or en)
--modelstep-asrASR model name
--out*(stdout)*Save transcription to file
--prompt*(none)*Hint text to improve accuracy for domain-specific terms
--format-type*(auto)*Audio format: pcm, mp3, ogg (auto-detected from extension)
--sample-rate16000Audio sample rate in Hz
--no-streamfalseOnly print the final complete result
--jsonfalseOutput as JSON with usage statistics
--no-itnfalseDisable inverse text normalization
--no-rerunfalseDisable second-pass error correction

API key

Set STEPFUN_API_KEY environment variable, or configure it in ~/.openclaw/openclaw.json:

{
  skills: {
    "step-asr": {
      apiKey: "YOUR_STEPFUN_API_KEY"
    }
  }
}

Get your API key from Step Platform.

适合场景

01

OpenClaw 用户查找和安装 Skill 时

02

用户想查找某类 Agent Skill 时

03

需要根据任务场景推荐可安装能力包时

04

需要对比不同来源的安装命令和来源信息时

能力概览

能力 1

按任务关键词查找相关 Skills

能力 2

展示可复制的安装命令

能力 3

保留来源站点、仓库和原始说明,方便继续核验

能力 4

补充不同宿主或平台的使用分布数据

能力 5

展示第三方安全扫描或审计结果

安装后应在对应宿主中按原始 README 的触发条件使用;具体调用方式请以来源页面和 README 为准。

平台分布

OpenClaw

84.84%
按下载量换算3,013

安全审计

VirusTotal

通过

ClawScan

通过

Static analysis

未展示

权限和风险

敏感数据

该 Skill 可能接触密钥、Token、环境变量或敏感配置,应进入高风险复核队列,默认不自动发布。

安装前确认

本站仅展示第三方公开信息,不托管安装包,不提供自动安装或运行环境。安装前应自行审查源码、依赖和命令行为。当前只有一个来源,正式发布前建议补源仓库或其他目录站核验。

来源信息

继续浏览同类 Skills