Models/Transcription
Audio

Transcription

by OpenAI

Whisper-based speech-to-text with timestamps, diarisation, and translation for long recordings.

Capabilities

  • Speech to text
  • Timestamps
  • Translation

Available models

Pass any of these IDs in the model field.

Model IDDetailPrice
whisper-v3per minute$0.006 / minute
gpt-4o-transcribeper minute$0.010 / minute

Pricing starts at

$0.006 / minute

Pay only for what you use. Each response returns the exact amount settled against your balance — no subscriptions, no minimums.

Quickstart

Transcription · whisper-v3

cURL
curl -X POST https://capi.ai/api/v1/audio/speech \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -H "Content-Type: application/json" \
  -d '{"model":"whisper-v3","input":"Welcome to CAPI."}' \
  --output out.mp3