Eleven v3

AUDIO GEN
Elevenlabs
New

Eleven v3 is a text-to-audio model designed for expressive speech synthesis. It supports audio tags for controlling emotion and delivery, multi-speaker dialogue, and covers 70+ languages with a 5,000 character limit.

Docs

Capabilities

Multilingual
Audio output

Supported languages

af
ar
as
az
be
bg
bn
bs
ca
ceb
cs
cy
da
de
el
en
es
et
fa
fi
fil
fr
ga
gl
gu
ha
he
hi
hr
hu
hy
id
is
it
ja
jv
ka
kk
kn
ko
ky
lb
ln
lt
lv
mk
ml
mr
ms
ne
nl
no
ny
pa
pl
ps
pt
ro
ru
sd
sk
sl
so
sr
sv
sw
ta
te
th
tr
uk
ur
vi
zh

Supported output media

audio

Supported generation options

Voices

Roger - Laid-Back, Casual, Resonant
Sarah - Mature, Reassuring, Confident
Laura - Enthusiast, Quirky Attitude
Charlie - Deep, Confident, Energetic
George - Warm, Captivating Storyteller
Callum - Husky Trickster
River - Relaxed, Neutral, Informative
Harry - Fierce Warrior
Liam - Energetic, Social Media Creator
Alice - Clear, Engaging Educator
Matilda - Knowledgable, Professional
Will - Relaxed Optimist
Jessica - Playful, Bright, Warm
Eric - Smooth, Trustworthy
Bella - Professional, Bright, Warm
Chris - Charming, Down-to-Earth
Brian - Deep, Resonant and Comforting
Daniel - Steady Broadcaster
Lily - Velvety Actress
Adam - Dominant, Firm
Bill - Wise, Mature, Balanced
Michael Anthony
LINA

Formats

mp3
pcm
ulaw

Supported tools

No tools enabled.

Pricing

TypeCreditsUnits
Generation1330.00Credits per 1,000 characters

Variants

No variants available for this model.

Try This Model

Write a prompt and experiment with Eleven v3 in the model experiments page. You can compare it with other models side by side.