SKILL.md
唯讀
名稱
openai-whisper-api
描述
透過 curl 呼叫 OpenAI 語音轉寫 API;支援 gpt-4o-transcribe、mini、diarize 或 whisper-1。
OpenAI 語音轉寫 API
透過 /v1/audio/transcriptions 進行語音轉寫。如需使用相容於 OpenAI 的代理伺服器或本機閘道,請設定 OPENAI_BASE_URL。
快速開始
{baseDir}/scripts/transcribe.sh /path/to/audio.m4a
預設設定:
- 模型:
gpt-4o-transcribe - 輸出:
<input>.txt
常用參數
{baseDir}/scripts/transcribe.sh /path/to/audio.ogg --model gpt-4o-transcribe --out /tmp/transcript.txt
{baseDir}/scripts/transcribe.sh /path/to/audio.ogg --model gpt-4o-mini-transcribe
{baseDir}/scripts/transcribe.sh /path/to/audio.ogg --model gpt-4o-transcribe-diarize --json
{baseDir}/scripts/transcribe.sh /path/to/audio.ogg --model whisper-1
{baseDir}/scripts/transcribe.sh /path/to/audio.m4a --language en
{baseDir}/scripts/transcribe.sh /path/to/audio.m4a --prompt "Speaker names: Peter, Daniel"
{baseDir}/scripts/transcribe.sh /path/to/audio.m4a --json --out /tmp/transcript.json
注意事項:
- 支援的上傳格式包含
mp3、mp4、mpeg、mpga、m4a、wav、webm。 - 官方代管 API 的上傳限制為 25 MB。
- 若需要語者標籤(區分說話者),請使用 diarize;腳本會自動傳送
chunking_strategy=auto並拒絕--prompt。
API 金鑰
設定 OPENAI_API_KEY,或是於作用中的 OpenClaw 設定檔中配置($OPENCLAW_CONFIG_PATH,預設為 ~/.openclaw/openclaw.json)。亦可選擇性設定 OPENAI_BASE_URL:
{
skills: {
"openai-whisper-api": {
apiKey: "OPENAI_KEY_HERE",
},
},
}






