> This is a page from the ElevenLabs documentation. For a complete page index, fetch https://elevenlabs.io/docs/llms.txt. For the full documentation in a single file, fetch https://elevenlabs.io/docs/llms-full.txt.

# Snabbstart för Speech to Text

Den här guiden visar hur du omvandlar talat ljud till text med Speech to Text API:t.

> **Tip**
>
> Använd [ElevenLabs tal-till-text-skill](https://github.com/elevenlabs/skills/tree/main/speech-to-text) för att transkribera ljud från din AI-kodningsassistent:
>
> ```bash
> npx skills add elevenlabs/skills --skill speech-to-text
> ```

> **Info**
>
> Den här handledningen visar hur du använder batch-API:t för Speech to Text. För en guide om hur du använder
> API:t för Speech to Text i realtid, se guiderna för [streaming på klientsidan](/docs/sv/eleven-api/guides/how-to/speech-to-text/realtime/client-side-streaming) eller [streaming på serversidan](/docs/sv/eleven-api/guides/how-to/speech-to-text/realtime/server-side-streaming).

## Använda Speech to Text API:t

#### Skapa en API-nyckel

[Skapa en API-nyckel i kontrollpanelen här](https://elevenlabs.io/app/settings/api-keys), som du använder för att säkert [få åtkomst till API:et](/docs/sv/api-reference/authentication).

Spara nyckeln som en hanterad hemlighet och skicka den till SDK:erna antingen som en miljövariabel via en `.env`-fil eller direkt i appens konfiguration, beroende på vad du föredrar.

**`.env`**

```js title=".env"
ELEVENLABS_API_KEY=<your_api_key_here>
```

#### Installera SDK:t

#### SDK

Vi använder också biblioteket `dotenv` för att läsa in vår API-nyckel från en miljövariabel.

```python
pip install elevenlabs
pip install python-dotenv
```

```typescript
npm install @elevenlabs/elevenlabs-js
npm install dotenv
```

#### CLI

Installera ElevenLabs CLI. Homebrew (macOS) och Scoop (Windows) rekommenderas.

**`Homebrew (macOS)`**

```bash title="Homebrew (macOS)"
brew install elevenlabs/tap/elevenlabs
```

**`Scoop (Windows)`**

```powershell title="Scoop (Windows)"
scoop bucket add elevenlabs https://github.com/elevenlabs/scoop-bucket
scoop install elevenlabs
```

**`npm`**

```bash title="npm"
npm install -g @elevenlabs/cli
```

**`curl`**

```bash title="curl"
curl --proto '=https' --tlsv1.2 -LsSf https://github.com/elevenlabs/cli/releases/latest/download/elevenlabs-cli-installer.sh | sh
```

> **Tip**
>
> Arbetar du med en AI-kodningsassistent? Kör `elevenlabs generate-skills` i ditt projekt för att skapa en
> `SKILL.md` för varje kommandogrupp i `skills/`, så att assistenten känner till hela CLI:ts yta
> utan att du behöver klistra in dokumentation. Använd `--output-dir` för att lägga dem någon annanstans. Detta läser CLI:ts egen
> inbäddade API-definition, så det kräver ingen API-nyckel och fungerar offline — och det följer
> den version av CLI:t som du har installerad.

Autentisera sedan — detta öppnar webbläsaren så att du kan auktorisera CLI:t:

```bash
elevenlabs auth login
```

#### Gör API-begäran

#### SDK

Skapa en ny fil med namnet `example.py` eller `example.mts`, beroende på vilket språk du väljer, och lägg till följande kod:

```python maxLines=0
# example.py
import os
from dotenv import load_dotenv
from io import BytesIO
import requests
from elevenlabs.client import ElevenLabs

load_dotenv()

elevenlabs = ElevenLabs(
  api_key=os.getenv("ELEVENLABS_API_KEY"),
)

audio_url = (
    "https://storage.googleapis.com/eleven-public-cdn/audio/marketing/nicole.mp3"
)
response = requests.get(audio_url)
audio_data = BytesIO(response.content)

transcription = elevenlabs.speech_to_text.convert(
    file=audio_data,
    model_id="scribe_v2", # Model to use
    tag_audio_events=True, # Tag audio events like laughter, applause, etc.
    language_code="eng", # Language of the audio file. If set to None, the model will detect the language automatically.
    diarize=True, # Whether to annotate who is speaking
)

print(transcription)
```

```typescript maxLines=0
// example.mts
import { ElevenLabsClient } from "@elevenlabs/elevenlabs-js";
import "dotenv/config";

const elevenlabs = new ElevenLabsClient();

const response = await fetch(
  "https://storage.googleapis.com/eleven-public-cdn/audio/marketing/nicole.mp3"
);
const audioBlob = new Blob([await response.arrayBuffer()], { type: "audio/mp3" });

const transcription = await elevenlabs.speechToText.convert({
  file: audioBlob,
  modelId: "scribe_v2", // Model to use
  tagAudioEvents: true, // Tag audio events like laughter, applause, etc.
  languageCode: "eng", // Language of the audio file. If set to null, the model will detect the language automatically.
  diarize: true, // Whether to annotate who is speaking
});

console.log(transcription);
```

Kör sedan den:

```python
python example.py
```

```typescript
npx tsx example.mts
```

Du bör se transkriberingen av ljudfilen skrivas ut i konsolen.

> **Note**
>
> För medicinskt och kliniskt ljud anger du `model_id` till `scribe_v2_medical`. Begärans format
> är detsamma som för `scribe_v2` och debiteras enligt samma pris. Se [Scribe v2 Medical](/docs/sv/overview/models#scribe-v2-medical).

#### CLI

Hämta exempelljudet och transkribera det sedan:

```bash
curl -O https://storage.googleapis.com/eleven-public-cdn/audio/marketing/nicole.mp3

elevenlabs speech-to-text convert \
  --file nicole.mp3 \
  --model-id scribe_v2 \
  --tag-audio-events true \
  --language-code eng \
  --diarize true
```

Transkriberingen skrivs ut i terminalen.

För medicinskt och kliniskt ljud skickar du `--model-id scribe_v2_medical`.

## Nästa steg

#### [Batchtranskribering](/docs/sv/eleven-api/guides/how-to/speech-to-text/batch)

Transkribera förinspelade ljudfiler med talardiarisering och händelsetaggning

#### [Realtidstranskribering](/docs/sv/eleven-api/guides/how-to/speech-to-text/realtime)

Streama ljud och få transkriberingar i realtid

#### [API-referens](/docs/sv/api-reference/speech-to-text/convert)

Utforska alla parametrar och svarsformat för Speech to Text