它能做什么
中文摘要
「asr」来自 joeseesun/qiaomu-cut-skill 的公开 SKILL.md。原文定位是:把音频文件转写成文本,适合给视频、播客、会议录音或素材库做初稿。它适合下载视频、音频、字幕和元数据,做可复核素材留档。
为什么推荐
推荐理由
推荐它,是因为这是 joeseesun 仓库中可直接追溯到原始 SKILL.md 的条目,文档路径为「vendor/marswaveai-skills/asr/SKILL.md」。相比只看仓库名,原文给出了触发场景、执行边界或操作步骤,适合在需要这类能力时直接安装或作为模板改造。
什么时候用
适用场景
- 下载视频、音频、字幕和元数据,做可复核素材留档
- 下载、剪辑、转写、配音、生成或整理音视频素材
- 制作字幕、播客、音乐、短视频和多媒体发布资产
使用前先看
主要亮点
- 01
Transcribe audio files to text using local speech recognition。
- 02
User wants 到 transcribe an 音频 file 到 text。
- 03
User provides an 音频 file path 和 asks 用于 transcription。
- 04
文档重点章节:When to Use、When NOT to Use、Purpose。
原始文档
原文摘录
Transcribe audio files to text using local speech recognition.