详情

首页手游攻略 OpenAI Whisper CLI:本地音频转录 - Openclaw Skills

OpenAI Whisper CLI:本地音频转录 - Openclaw Skills

佚名 2026-08-11 13:35:01
下载入口:https://github.com/openclaw/skills/tree/main/skills/steipete/openai-whisper

安装与下载

1. ClawHub CLI

从源直接安装技能的最快方式。

npx clawhub@latest install openai-whisper

2. 手动安装

将技能文件夹复制到以下位置之一

全局模式 ~/.openclaw/skills/ 工作区 <project>/skills/

优先级:工作区 > 本地 > 内置

3. 提示词安装

将此提示词复制到 OpenClaw 即可自动安装。

请帮我使用 Clawhub 安装 openai-whisper。如果尚未安装 Clawhub,请先安装(npm i -g clawhub)。

什么是 OpenAI Whisper CLI?

该技能通过利用 OpenAI Whisper CLI 为高性能本地语音转文字处理提供无缝接口。通过完全在本地硬件上运行转录任务,它确保了最高的数据隐私,并消除了与云端 API 订阅相关的持续费用。用户可以将此工具集成到其 Openclaw Skills 集合中,以安全高效地处理敏感音频数据。

Whisper 是一种先进的语音识别模型,在多样化的音频数据集上进行过训练,使其在对抗背景噪音和各种口音方面具有极强的鲁棒性。该技能允许开发人员和研究人员在保持本地优先开发理念的同时,弥合原始录音与结构化文本数据之间的差距。

OpenAI Whisper CLI 应用场景

  • 为会议和采访生成 MP3 或 M4A 音频文件的纯文本转录。
  • 通过自动翻译和时间戳为视频内容创建 SRT 字幕文件。
  • 为大型媒体库自动化批量转录工作流,无需上传至云端。
  • 使用 Openclaw Skills 在本地开发环境中实现私有语音转文本处理。
OpenAI Whisper CLI 工作原理
  1. 用户通过提供音频文件路径并选择转录模型来启动技能。
  2. 技能触发本地 Whisper CLI,后者从本地缓存目录加载所需的机器学习模型。
  3. Whisper 在本地处理音频数据,根据用户的标记执行转录或翻译。
  4. 输出以请求的格式(如 TXT、SRT 或 JSON)生成并保存到指定的输出目录。

OpenAI Whisper CLI 配置指南

要使用此技能,请确保您的系统上已安装 Whisper CLI。对于 macOS 用户,可以通过 Homebrew 轻松安装:

brew install openai-whisper

首次执行时,该工具将下载必要的模型文件到 ~/.cache/whisper。请确保您为打算使用的模型预留了足够的磁盘空间。

OpenAI Whisper CLI 数据架构与分类体系

该技能通过结构化的本地工作流管理音频处理和文本生成。下表描述了数据的处理方式:

数据组件 详情
模型存储 模型本地缓存在 ~/.cache/whisper 中以避免重复下载
输入支持 支持处理标准音频格式,包括 MP3、M4A 和 WAV
输出格式 支持生成 TXT、SRT、VTT、TSV 和 JSON 文件
配置 默认模型设置为 turbo,以实现速度和准确性的高性能平衡
name: openai-whisper
description: Local speech-to-text with the Whisper CLI (no API key).
homepage: https://openai.com/research/whisper
metadata: {"clawdbot":{"emoji":"???","requires":{"bins":["whisper"]},"install":[{"id":"brew","kind":"brew","formula":"openai-whisper","bins":["whisper"],"label":"Install OpenAI Whisper (brew)"}]}}

Whisper (CLI)

Use whisper to transcribe audio locally.

Quick start

  • whisper /path/audio.mp3 --model medium --output_format txt --output_dir .
  • whisper /path/audio.m4a --task translate --output_format srt

Notes

  • Models download to ~/.cache/whisper on first run.
  • --model defaults to turbo on this install.
  • Use smaller models for speed, larger for accuracy.
点击查看更多
推荐专题
热门阅读