Hoppa till navigering

Så väljer du rätt modell

Den här guiden visar hur du väljer rätt ElevenLabs-modell för ditt användningsfall.

ElevenLabs erbjuder ett urval av modeller som är optimerade för olika behov. Rätt val beror på ditt användningsfall, dina latenskrav och kvalitetsförväntningar. Se modellreferensen för fullständiga specifikationer.

Efter behov

Kvalitet

Använd eleven_v4

Flaggskeppsmodellen med högst återgivningstrohet, rikast känslouttryck och bredast språkstöd.

Låg latens

Använd eleven_v4_turbo

Optimerad för realtidsapplikationer med cirka 100 ms latens.

Efter användningsfall

Innehållsskapande

Använd eleven_v4

Perfekt för professionellt innehåll, ljudböcker och videoberättarröst.

Konversationsagenter

Använd eleven_v4_turbo för det mest uttrycksfulla framförandet, eller eleven_flash_v2_5 och eleven_flash_v2 för lägst latens.

Använd 2.5-modellen för språkstöd utanför engelska.

Optimerad för konversationsapplikationer i realtid.

Transkribering

Använd scribe_v2 för batchtranskribering, scribe_v2_medical för medicinskt och kliniskt ljud eller scribe_v2_realtime för transkribering i realtid.

Branschledande noggrannhet för fler än 90 språk med talardiarisering och tidsstämplar på ordnivå.

Röstförändrare

Använd eleven_multilingual_sts_v2

Specialiserad för Speech to Speech-konvertering.

Nästa steg