Fi
Fully Infor
med
Run a panel →
Models
›
Speech
Speech (text-to-speech) models
Models that synthesise natural speech from text. 12 models available.
← All models
C
Canopylabs
C
Canopy Labs: Orpheus 3B
$7.00 / 1M tokens
D
Deepgram
D
Deepgram: Aura-2
$30.00 / 1M tokens
Google
Google: Gemini 3.1 Flash TTS Preview
$1.00 in · $20.00 out / 1M
H
Hexgrad
H
hexgrad: Kokoro 82M
$0.62 / 1M tokens
M
Microsoft
M
Microsoft: MAI-Voice-2
$22.00 / 1M tokens
M
Minimax
M
MiniMax: Speech 2.8 HD
$100.00 / 1M tokens
M
MiniMax: Speech 2.8 Turbo
$60.00 / 1M tokens
M
Mistralai
M
Mistral: Voxtral Mini TTS
$16.00 / 1M tokens
S
Sesame
S
Sesame: CSM 1B
$7.00 / 1M tokens
X-ai
xAI: Grok Voice TTS 1.0
$15.00 / 1M tokens
Z
Zyphra
Z
Zyphra: Zonos v0.1 Hybrid
$7.00 / 1M tokens
Z
Zyphra: Zonos v0.1 Transformer
$7.00 / 1M tokens
← All models