Use Gemini TTS Models to convert your prompts to real audio.

Google logo
fal-ai/gemini-tts

Use Gemini TTS Models to convert your prompts to real audio.
Inference
Commercial use
Partner

Input

Additional Settings

Customize your input with more control.

Your request will cost 0.5$ per 1 M input tokens and 10$ per 1 M output token for flash model. Cost will be double for pro model.

Result

Idle

What would you like to do next?

Your request will cost 0.5$ per 1 M input tokens and 10$ per 1 M output token for flash model. Cost will be double for pro model.

Gemini TTS (Text to Audio) API on fal