LLM Skills
~/catalogue/audio & voix//SKILL
Audio & voixsource GitHub

OpenAI transcriptions API

/SKILL

Transcrivez les fichiers audio via `/v1/audio/transcriptions`. Définissez `OPENAI_BASE_URL` comme proxy ou passerelle locale compatible avec OpenAI.

openclawopenclaw
386.5k
5 juin 2026
NOASSERTION
// contenu du skill

name: openai-whisper-api

description: "OpenAI Audio Transcriptions API via curl; gpt-4o-transcribe, mini, diarize, or whisper-1."

homepage: https://platform.openai.com/docs/guides/speech-to-text

metadata:

{

"openclaw":

{

"emoji": "🌐",

"requires": { "bins": ["curl", "node"], "env": ["OPENAIAPIKEY"] },

"primaryEnv": "OPENAIAPIKEY",

"install":

[

{

"id": "brew",

"kind": "brew",

"formula": "curl",

"bins": ["curl"],

"label": "Install curl (brew)",

},

],

},

}


OpenAI transcriptions API

Transcribe audio through /v1/audio/transcriptions. Set OPENAI_BASE_URL for an OpenAI-compatible proxy or local gateway.

Quick start

bash
{baseDir}/scripts/transcribe.sh /path/to/audio.m4a

Defaults:

  • Model: gpt-4o-transcribe
  • Output: <input>.txt

Useful flags

bash
{baseDir}/scripts/transcribe.sh /path/to/audio.ogg --model gpt-4o-transcribe --out /tmp/transcript.txt
{baseDir}/scripts/transcribe.sh /path/to/audio.ogg --model gpt-4o-mini-transcribe
{baseDir}/scripts/transcribe.sh /path/to/audio.ogg --model gpt-4o-transcribe-diarize --json
{baseDir}/scripts/transcribe.sh /path/to/audio.ogg --model whisper-1
{baseDir}/scripts/transcribe.sh /path/to/audio.m4a --language en
{baseDir}/scripts/transcribe.sh /path/to/audio.m4a --prompt "Speaker names: Peter, Daniel"
{baseDir}/scripts/transcribe.sh /path/to/audio.m4a --json --out /tmp/transcript.json

Notes:

  • Supported upload formats include mp3, mp4, mpeg, mpga, m4a, wav, webm.
  • 25 MB upload limit on the hosted API.
  • Use diarize for speaker labels; script sends chunking_strategy=auto and rejects --prompt.

API key

Set OPENAI_API_KEY, or configure it in the active OpenClaw config file ($OPENCLAW_CONFIG_PATH, default ~/.openclaw/openclaw.json). Optionally set OPENAI_BASE_URL:

json5
{
  skills: {
    "openai-whisper-api": {
      apiKey: "OPENAI_KEY_HERE",
    },
  },
}
// source originale publique
openclaw/openclaw
/skills/openai-whisper-api/SKILL.md
Licence : NOASSERTION. Consultez le dépôt avant toute réutilisation.
Projet indépendant, non affilié à Anthropic. Ce skill reste la propriété de son auteur original.
// installer ce skill
Collez cette commande dans votre terminal à la racine de votre projet :
mkdir -p .claude/commands && curl -o ".claude/commands/SKILL.md" "https://raw.githubusercontent.com/openclaw/openclaw/main/skills/openai-whisper-api/SKILL.md"
Ensuite dans Claude Code, tapez /SKILL pour l'activer.
open_in_newVoir la source originale
// sauvegarder
Sauvegarde disponible après connexion.
loginSe connecter pour sauvegarder
// informations
Créateuropenclaw
Étoiles 386.5k
CatégorieAudio & voix
LicenceNOASSERTION
Mis à jour5 juin 2026
Format.md
AccèsGratuit
// similaires

Skills Audio & voix

Voir toutarrow_forward