S2 Pro Text To Speech

AUDIO GEN
Fish Audio

Fish Audio S2 Pro Text To Speech is an audio-generation model that converts text into natural speech with support for voice cloning via reference audio, multi-speaker dialogue, prosody controls, and multiple output formats.

Capabilities

Audio output

Supported output media

audio

Supported generation options

Formats

wav
pcm
mp3
opus

Supported tools

No tools enabled.

Pricing

TypeCreditsUnits
Generation199.50Credits per 1,000 characters

Variants

No variants available for this model.

Try This Model

Write a prompt and experiment with S2 Pro Text To Speech in the model experiments page. You can compare it with other models side by side.