AI audio models

Text-to-speech, music generation and speech-to-text.

Audio · 10

ModelModePriceAspect ratios
ElevenLabs v3 Text-to-SpeechText to speechfrom 200 credits—Open →
xAI TTS v1Text to speechfrom 30 credits—Open →
MiniMax Speech 2.6 HDAudiofrom 160 credits—Open →
MiniMax Speech 2.6 TurboAudiofrom 96 credits—Open →
Gemini 3.1 Flash TTSText to speechfrom 300 credits—Open →
Seed Audio 1.0Audiofrom 572 credits—Open →
MiniMax Music 2.6Musicfrom 300 credits—Open →
xAI STT v1Speech to textfrom 4 credits—Open →
Gemini 2.5 Flash TTSText to speechfrom 80 credits—Open →
Gemini 2.5 Pro TTSText to speechfrom 160 credits—Open →