openai-whisper-api

openai-whisper-api

熱門

透過 curl 呼叫 OpenAI 語音轉寫 API;支援 gpt-4o-transcribe、mini、diarize 或 whisper-1。

38萬星標
8.1萬分支
更新於 2026/7/25
SKILL.md
唯讀
名稱
openai-whisper-api
描述

透過 curl 呼叫 OpenAI 語音轉寫 API;支援 gpt-4o-transcribe、mini、diarize 或 whisper-1。

OpenAI 語音轉寫 API

透過 /v1/audio/transcriptions 進行語音轉寫。如需使用相容於 OpenAI 的代理伺服器或本機閘道,請設定 OPENAI_BASE_URL

快速開始

{baseDir}/scripts/transcribe.sh /path/to/audio.m4a

預設設定:

  • 模型:gpt-4o-transcribe
  • 輸出:<input>.txt

常用參數

{baseDir}/scripts/transcribe.sh /path/to/audio.ogg --model gpt-4o-transcribe --out /tmp/transcript.txt
{baseDir}/scripts/transcribe.sh /path/to/audio.ogg --model gpt-4o-mini-transcribe
{baseDir}/scripts/transcribe.sh /path/to/audio.ogg --model gpt-4o-transcribe-diarize --json
{baseDir}/scripts/transcribe.sh /path/to/audio.ogg --model whisper-1
{baseDir}/scripts/transcribe.sh /path/to/audio.m4a --language en
{baseDir}/scripts/transcribe.sh /path/to/audio.m4a --prompt "Speaker names: Peter, Daniel"
{baseDir}/scripts/transcribe.sh /path/to/audio.m4a --json --out /tmp/transcript.json

注意事項:

  • 支援的上傳格式包含 mp3mp4mpegmpgam4awavwebm
  • 官方代管 API 的上傳限制為 25 MB。
  • 若需要語者標籤(區分說話者),請使用 diarize;腳本會自動傳送 chunking_strategy=auto 並拒絕 --prompt

API 金鑰

設定 OPENAI_API_KEY,或是於作用中的 OpenClaw 設定檔中配置($OPENCLAW_CONFIG_PATH,預設為 ~/.openclaw/openclaw.json)。亦可選擇性設定 OPENAI_BASE_URL

{
  skills: {
    "openai-whisper-api": {
      apiKey: "OPENAI_KEY_HERE",
    },
  },
}