Fi
Fully Infor
med
Run a panel →
Models
›
Speech
Speech (text-to-speech) models
Models that synthesise natural speech from text. 18 models available.
← All models
C
Canopylabs
C
Canopy Labs: Orpheus 3B
$7.00 / 1M tokens
D
Deepgram
D
Deepgram: Aura-2
$30.00 / 1M tokens
D
Deepgram: Flux TTS (free)
Free
F
Fish-audio
F
Fish Audio: S1
$15.00 / 1M tokens
F
Fish Audio: S2 Pro
$15.00 / 1M tokens
F
Fish Audio: S2.1 Pro
$15.00 / 1M tokens
F
Fish Audio: S2.1 Pro Free (free)
Free
Google
Google: Gemini 3.1 Flash TTS Preview
$1.00 in · $20.00 out / 1M
H
Hexgrad
H
hexgrad: Kokoro 82M
$4.00 / 1M tokens
M
Microsoft
M
Microsoft AI: MAI-Voice-2
$22.00 / 1M tokens
M
Microsoft AI: MAI-Voice-2-Flash
$15.00 / 1M tokens
M
Minimax
M
MiniMax: Speech 2.8 HD
$100.00 / 1M tokens
M
MiniMax: Speech 2.8 Turbo
$60.00 / 1M tokens
M
Mistralai
M
Mistral: Voxtral Mini TTS
$16.00 / 1M tokens
Q
Qwen
Q
Qwen: Qwen-Audio-3.0-TTS Flash
$15.00 / 1M tokens
Q
Qwen: Qwen-Audio-3.0-TTS Plus
$20.00 / 1M tokens
S
Sesame
S
Sesame: CSM 1B
$7.00 / 1M tokens
X-ai
SpaceXAI: Grok Voice TTS 1.0
$15.00 / 1M tokens
← All models