Audio
Gemini TTS
by Google
Gemini TTS API access for multi-speaker dialogue with configurable voices, accents, delivery styles, and pacing.
Capabilities
- Text to speech
- Multi-speaker
- Dialogue
Available models
Pass any of these IDs in the model field.
| Model ID | Detail | Price |
|---|---|---|
| gemini-3-tts | per 1K tokens | $0.0014 / 1K tokens |
Pricing starts at
$0.0014 / 1K tokens
Pay only for what you use. Each response returns the exact amount settled against your balance — no subscriptions, no minimums.
Quickstart
Gemini TTS · gemini-3-tts
cURL
curl -X POST https://capi.ai/api/v1/audio/speech \
-H "Authorization: Bearer YOUR_API_TOKEN" \
-H "Content-Type: application/json" \
-d '{"model":"gemini-3-tts","input":"Welcome to CAPI."}' \
--output out.mp3More Audio models
View allAudio
ElevenLabs
ElevenLabs
ElevenLabs API access for voice synthesis, text-to-speech, sound effects, speech-to-text, and audio isolation.
from $0.040 / 1K charsView
Audio
Fish Audio
Fish Audio
Fish Audio API access for expressive multilingual and production-grade text-to-speech with managed MP3 or WAV output.
from $0.0000 / 1K UTF-8 bytesView
Audio
OpenAI TTS
OpenAI
OpenAI text-to-speech with low-latency streaming voices for real-time assistants.
from $0.015 / 1K charsView