> This is a page from the ElevenLabs documentation. For a complete page index, fetch https://elevenlabs.io/docs/llms.txt. For the full documentation in a single file, fetch https://elevenlabs.io/docs/llms-full.txt.

# Latensoptimering

Den här guiden täcker de grundläggande principerna för att förbättra text-till-tal-latensen. För en förklaring av vad latens är och vad som bidrar till den, se [Förstå latens](/docs/sv/eleven-api/concepts/latency).

Det finns många enskilda tekniker, men vi delar in dem i **fyra principer**.

#### Fyra principer

1. [Använd Flash-modeller](#use-flash-models)
2. [Utnyttja streaming](#leverage-streaming)
3. [Tänk på geografisk närhet](#consider-geographic-proximity)
4. [Välj lämpliga röster](#choose-appropriate-voices)

> **Success**
>
> Enterprise-kunder får högre samtidighetsgränser och prioriterad åtkomst till vår renderingskö. [Kontakta säljteamet](https://elevenlabs.io/contact-sales) om du vill veta mer om våra Enterprise-
> abonnemang.

## Använd Flash-modeller

[Flash-modeller](/docs/sv/overview/models#flash-v25) ger slutledningshastigheter på cirka 75 ms, vilket gör dem perfekta för realtidsapplikationer. Avvägningen är en liten försämring av ljudkvaliteten jämfört med [Multilingual v2](/docs/sv/overview/models#multilingual-v2).

> **Info**
>
> 75 ms avser endast modellens slutledningstid. Den faktiska latensen från början till slut varierar
> beroende på faktorer som din plats och vilken endpoint-typ du använder.

## Utnyttja streaming

Det finns tre typer av text-till-tal-endpoints i vår [API-referens](/docs/sv/api-reference/introduction):

* **Vanlig endpoint**: Returnerar en komplett ljudfil i ett enda svar.
* **Streaming-endpoint**: Returnerar ljuddelar löpande med [Server-sent events](https://html.spec.whatwg.org/multipage/server-sent-events.html#server-sent-events).
* **WebSocket-endpoint**: Möjliggör dubbelriktad streaming för ljudgenerering i realtid.

### Streaming

Streaming-endpoints returnerar löpande ljud medan det genereras i realtid, vilket minskar tiden till första byte. Den här endpointen rekommenderas när inmatningstexten finns tillgänglig från början.

> **Info**
>
> Streaming stöds för [Text to Speech](/docs/sv/api-reference/text-to-speech/stream) API,
> [Voice Changer](/docs/sv/api-reference/speech-to-speech/stream) API och [Audio Isolation](/docs/sv/api-reference/audio-isolation/stream) API.

### WebSockets

[text-till-tal-WebSocket-endpointen](/docs/sv/api-reference#text-to-speech-websocket) har stöd för dubbelriktad streaming, vilket gör den perfekt för applikationer med textinmatning i realtid (t.ex. utdata från LLM:er).

> **Tip**
>
> Om du ställer in `auto_mode` på true hanteras genereringstriggers automatiskt, så att du slipper
> hantera chunk-strategier manuellt.

Om `auto_mode` är inaktiverat väntar modellen på tillräckligt med text för att matcha chunk-schemat innan den börjar generera ljud.

Om du till exempel anger ett chunk-schema på 125 tecken men endast 50 kommer in, väntar modellen tills ytterligare tecken anländer – vilket kan öka latensen.

Mer information om implementering finns i [guiden för text-till-tal med WebSocket](/docs/sv/api-reference#text-to-speech-websocket).

## Välj lämpliga röster

Vi har sett att röstvalet i vissa fall kan påverka latensen. Här är ordningen från snabbast till långsammast:

1. Standardröster (tidigare förskapade), syntetiska röster och Instant Voice Clones (IVC)
2. Professional Voice Clones (PVC)

Utdataformat med högre ljudkvalitet kan öka latensen. Se till att balansera dina latenskrav med behovet av ljudåtergivning.

> **Info**
>
> Vi arbetar aktivt med att optimera PVC-latensen för Flash v2.5.

## Tänk på geografisk närhet

Vi tillhandahåller våra modeller från flera regioner för att optimera latensen utifrån din geografiska plats.

När du till exempel använder Flash-modeller med WebSockets kan du förvänta dig följande TTFB-latens beroende på var du befinner dig:

| Region       | TTFB      |
| ------------ | --------- |
| Nordamerika  | 100-150ms |
| Europa       | 100-150ms |
| Sydostasien  | 100-150ms |
| Sydasien     | 150-200ms |
| Nordostasien | 150-200ms |

Du kan kontrollera vilken backend-region som hanterar din förfrågan genom att granska huvudet `x-region` i API-svaret.
Regioner som används för närvarande är USA, Nederländerna och Singapore.

> **Info**
>
> Enterprise-kunder kan använda våra dedikerade datalagringsmiljöer i EU och Indien för garantier
> om serverplats och låg latens. Kontakta din säljrepresentant för att komma igång med vår
> infrastruktur för datalagring.

Om du vill välja bort global routning och alltid använda servrar i USA använder du bas-URL:en `api.us.elevenlabs.io` för dina API-förfrågningar:

```python
import os
from elevenlabs.client import ElevenLabs

elevenlabs = ElevenLabs(
    api_key=os.getenv("ELEVENLABS_API_KEY"),
    base_url="https://api.us.elevenlabs.io"
)

```

```typescript
import { ElevenLabsClient } from "@elevenlabs/elevenlabs-js";
import "dotenv/config";

const elevenlabs = new ElevenLabsClient({
  apiKey: process.env.ELEVENLABS_API_KEY,
  baseUrl: "https://api.us.elevenlabs.io",
});
```

**`cURL`**

```bash cURL
curl -X POST -v "https://api.us.elevenlabs.io/v1/text-to-speech/{voice_id}" \
  -H "Accept: audio/mpeg" \
  -H "Content-Type: application/json" \
  -H "xi-api-key: YOUR_API_KEY" \
  -d '{
    "text": "Hello World!",
    "model_id": "eleven_flash_v2_5"
  }'
```

> **Warning**
>
> De globala servrarna krävde tidigare opt-in via bas-URL:en `api-global-preview.elevenlabs.io`.
> Detta behövs inte längre eftersom det nu är standardbeteendet. Uppdatera dina applikationer så att
> de i stället använder `api.elevenlabs.io`.