> This is a page from the ElevenLabs documentation. For a complete page index, fetch https://elevenlabs.io/docs/llms.txt. For the full documentation in a single file, fetch https://elevenlabs.io/docs/llms-full.txt.

# ElevenLabs dokumentation

## Så fungerar ElevenLabs

ElevenLabs erbjuder infrastruktur för AI-röster: text till tal, tal till text, röstkloning, konversationsagenter och generativt ljud. Du kan använda det på fyra sätt, anpassade för olika målgrupper.

**[ElevenCreative](/docs/sv/eleven-creative)** är en kodfri webbapplikation där kreatörer, producenter och redaktörer kan skapa voice-overs, musik, dubbningar och studioprojekt direkt i webbläsaren.

**[ElevenAgents](/docs/sv/eleven-agents)** är plattformen för att utforma och driva röstbaserade konversationsagenter, med en visuell byggare för icke-tekniska användare och full programmatisk kontroll för utvecklare.

**[ElevenAPI](/docs/sv/eleven-api)** ger tillgång till alla funktioner via ett REST-gränssnitt med officiella SDK:er för Python och TypeScript, så att utvecklare kan bädda in röst i sina egna applikationer och workflows.

**[Reception AI](/docs/sv/reception-ai)** är en AI-telefonreceptionist som är redo att driftsättas för små och medelstora företag. Den svarar på samtal, bokar möten och hanterar den dagliga verksamheten från en enda kontrollpanel.

### Koncept

**Röster** är de röstpersonor som används vid ljudgenerering. Varje röst har ett unikt ID — till exempel `JBFqnCBsd6RMkjVDRZzb` — som du väljer i kontrollpanelen eller skickar med i API-anrop. ElevenLabs har ett [bibliotek med över 10 000 röster](https://elevenlabs.io/app/voice-library). Du kan också klona en röst från en ljudinspelning eller generera en från en textbeskrivning.

**Modeller** styr kvaliteten, latensen och språkstödet för genererat ljud. [`eleven_v4`](/docs/sv/overview/models) ger det mest uttrycksfulla resultatet på över 90 språk. [`eleven_v4_turbo`](/docs/sv/overview/models) är avsedd för användning i realtid med en genomsnittlig inferenslatens på cirka 100 ms. Varje funktion — tal till text, musik, ljudeffekter — har sin egen dedikerade modell.

**Krediter** är förbrukningsenheten som delas mellan alla produkter. Text till tal kostar en kredit per tecken i indatatexten. Andra åtgärder debiteras per sekund bearbetat ljud. Krediter återställs varje månad och oanvända krediter förs över i upp till två månader. Se [priser](https://elevenlabs.io/pricing/api) för en fullständig översikt.

## Välj din väg

[![](/docs/_fern-files/elevenlabs.docs.buildwithfern.com/12097a437e55f60c199946cf59c9528eb8349d110142394833d67fe93b50e68d/assets/images/overview/voice-library-bg.webp)](/docs/sv/eleven-creative/overview)

### ElevenCreative

Lär dig använda ElevenCreative-plattformen med steg-för-steg-guider

[![](/docs/_fern-img/7375358c43ac5dd1a170937123f0874e01b3d8b6cf178c282805588a11d39593.webp)](/docs/sv/eleven-agents/overview)

### ElevenAgents

Lär dig bygga, lansera och skala agenter med ElevenLabs

[![](/docs/_fern-files/elevenlabs.docs.buildwithfern.com/002b2432fa6ab18befc9f1a6e7fadf348f46506a5a5a72a2358ba1e7f92d8ded/assets/images/overview/scribe-code-bg.webp)](/docs/sv/eleven-api/quickstart)

### ElevenAPI

Lär dig integrera med ElevenLabs API med exempel och handledningar

## Möt modellerna

#### [Eleven v4](/docs/sv/overview/models#eleven-v4)

Vår mest känslosamma modell för talsyntes med hög kvalitet

Exceptionella möjligheter till Voice Cloning

Stöd för över 90 språk

Gräns på 10 000 tecken

Stöd för naturliga dialoger med flera talare

#### [Eleven v4 Turbo](/docs/sv/overview/models#eleven-v4-turbo)

Vår mest känslosamma modell för talsyntes i realtid

Ultralåg latens (medianlatens för inferens på \~100 ms†)

Exceptionella möjligheter till Voice Cloning

Stöd för över 90 språk

Ljudtaggar för detaljerad kontroll

#### [Eleven v3](/docs/sv/overview/models#eleven-v3)

Vår känslomässigt rika och uttrycksfulla modell för talsyntes

Dramatiskt framförande och uttryck

Stöd för över 70 språk

Gräns på 5 000 tecken

Stöd för naturliga dialoger med flera talare

#### [Eleven v3 Conversational](/docs/sv/overview/models#eleven-v3-conversational)

Vår uttrycksfulla modell för talsyntes i realtid

Låg latens (\~280 ms)

Dramatiskt framförande och uttryck

Stöd för över 70 språk

Ljudtaggar för detaljerad kontroll

#### [Eleven Multilingual v2](/docs/sv/overview/models#multilingual-v2)

Modell för talsyntes med verklighetstroget och jämnt hög kvalitet

Naturligt ljudande resultat

Stöd för 29 språk

Gräns på 10 000 tecken

Mest stabil vid långa genereringar

#### [Eleven Flash v2.5](/docs/sv/overview/models#flash-v25)

Vår snabba och prisvärda modell för talsyntes

Ultralåg latens (\~75 ms†)

Stöd för 32 språk

Gräns på 40 000 tecken

Snabbare modell, 50 % lägre pris per tecken för API-genereringar

#### [Scribe v2](/docs/sv/overview/models#scribe-v2)

Avancerad modell för taligenkänning

Exakt transkribering på över 90 språk

Promptning med nyckeltermer, upp till 1 000 termer

Entitetsidentifiering, 65 entitetstyper

Redigering av transkriptioner med instruktioner på naturligt språk

Exakta tidsstämplar på ordnivå

Talarseparering, upp till 32 talare

Dynamisk ljudtaggning

Smart språkidentifiering

#### [Scribe v2 Realtime](/docs/sv/overview/models#scribe-v2-realtime)

Modell för taligenkänning i realtid

Exakt transkribering på över 90 språk

Transkribering i realtid

Låg fördröjning (\~150ms†)

Exakta tidsstämplar på ordnivå

Entitetsidentifiering, 65 entitetstyper

Redigering av transkriptioner med instruktioner på naturligt språk

#### [Scribe v2 Medical](/docs/sv/overview/models#scribe-v2-medical)

Taligenkänning finjusterad för kliniskt ljud

35 % färre transkriberingsfel för kliniskt ljud än Scribe v2

Samma precision för vardagligt tal som Scribe v2

Samma funktioner, språk, priser och API som Scribe v2

[Utforska alla](/docs/sv/overview/models)

† Exklusive applikations- och nätverkslatens

## Bläddra efter funktion

Text to Speech

Omvandla text till verklighetstroget tal

Speech to Text

Transkribera talat ljud till text

Musik

Generera musik från text

Text till dialog

Skapa naturligt låtande dialog från text

Bild och video

Generera bilder och videor från text

Röstförändrare

Ändra och omvandla röster

Röstisolering

Isolera röster från bakgrundsbrus

Dubbning

Dubbning av ljud och videor utan avbrott

Ljudeffekter

Skapa filmiska ljudeffekter

Röster

Klona och utforma anpassade röster

Röstremixning

Omvandla och förbättra befintliga röster

Tvingad synkronisering

Synkronisera text med ljud

Talmodul

Lägg till röst i vad som helst

ElevenAgents

Driftsätt intelligenta röstbaserade agenter

Privata driftsättningar

Kör ElevenLabs i ditt eget moln