SKILL.md
只读
名称
openai-whisper-api
描述
通过 curl 调用 OpenAI 音频转写 API;支持 gpt-4o-transcribe、mini、diarize 或 whisper-1 模型。
OpenAI 音频转写 API
通过 /v1/audio/transcriptions 接口转写语音。如需使用 OpenAI 兼容的反向代理或本地网关,可设置 OPENAI_BASE_URL。
快速开始
{baseDir}/scripts/transcribe.sh /path/to/audio.m4a
默认设置:
- 模型:
gpt-4o-transcribe - 输出路径:
<input>.txt
常用参数与示例
{baseDir}/scripts/transcribe.sh /path/to/audio.ogg --model gpt-4o-transcribe --out /tmp/transcript.txt
{baseDir}/scripts/transcribe.sh /path/to/audio.ogg --model gpt-4o-mini-transcribe
{baseDir}/scripts/transcribe.sh /path/to/audio.ogg --model gpt-4o-transcribe-diarize --json
{baseDir}/scripts/transcribe.sh /path/to/audio.ogg --model whisper-1
{baseDir}/scripts/transcribe.sh /path/to/audio.m4a --language en
{baseDir}/scripts/transcribe.sh /path/to/audio.m4a --prompt "Speaker names: Peter, Daniel"
{baseDir}/scripts/transcribe.sh /path/to/audio.m4a --json --out /tmp/transcript.json
注意事项:
- 支持上传的音频格式包括
mp3、mp4、mpeg、mpga、m4a、wav、webm。 - 云端 API 上传文件大小限制为 25 MB。
- 区分说话人(说话人标注)时使用 diarize 模型;此时脚本会自动发送
chunking_strategy=auto,且不支持--prompt参数。
API Key 配置
设置环境变量 OPENAI_API_KEY,或者在当前 OpenClaw 配置文件中进行配置(配置文件路径由 $OPENCLAW_CONFIG_PATH 指定,默认为 ~/.openclaw/openclaw.json)。也可以选择性配置 OPENAI_BASE_URL:
{
skills: {
"openai-whisper-api": {
apiKey: "OPENAI_KEY_HERE",
},
},
}






