openai-whisper-api

openai-whisper-api

热门

通过 curl 调用 OpenAI 音频转写 API;支持 gpt-4o-transcribe、mini、diarize 或 whisper-1 模型。

38万Star
8.1万Fork
更新于 2026/7/25
SKILL.md
只读
名称
openai-whisper-api
描述

通过 curl 调用 OpenAI 音频转写 API;支持 gpt-4o-transcribe、mini、diarize 或 whisper-1 模型。

OpenAI 音频转写 API

通过 /v1/audio/transcriptions 接口转写语音。如需使用 OpenAI 兼容的反向代理或本地网关,可设置 OPENAI_BASE_URL

快速开始

{baseDir}/scripts/transcribe.sh /path/to/audio.m4a

默认设置:

  • 模型:gpt-4o-transcribe
  • 输出路径:<input>.txt

常用参数与示例

{baseDir}/scripts/transcribe.sh /path/to/audio.ogg --model gpt-4o-transcribe --out /tmp/transcript.txt
{baseDir}/scripts/transcribe.sh /path/to/audio.ogg --model gpt-4o-mini-transcribe
{baseDir}/scripts/transcribe.sh /path/to/audio.ogg --model gpt-4o-transcribe-diarize --json
{baseDir}/scripts/transcribe.sh /path/to/audio.ogg --model whisper-1
{baseDir}/scripts/transcribe.sh /path/to/audio.m4a --language en
{baseDir}/scripts/transcribe.sh /path/to/audio.m4a --prompt "Speaker names: Peter, Daniel"
{baseDir}/scripts/transcribe.sh /path/to/audio.m4a --json --out /tmp/transcript.json

注意事项:

  • 支持上传的音频格式包括 mp3mp4mpegmpgam4awavwebm
  • 云端 API 上传文件大小限制为 25 MB。
  • 区分说话人(说话人标注)时使用 diarize 模型;此时脚本会自动发送 chunking_strategy=auto,且不支持 --prompt 参数。

API Key 配置

设置环境变量 OPENAI_API_KEY,或者在当前 OpenClaw 配置文件中进行配置(配置文件路径由 $OPENCLAW_CONFIG_PATH 指定,默认为 ~/.openclaw/openclaw.json)。也可以选择性配置 OPENAI_BASE_URL

{
  skills: {
    "openai-whisper-api": {
      apiKey: "OPENAI_KEY_HERE",
    },
  },
}