> This is a page from the ElevenLabs documentation. For a complete page index, fetch https://elevenlabs.io/docs/llms.txt. For the full documentation in a single file, fetch https://elevenlabs.io/docs/llms-full.txt.

# Skapa talgenerering

POST https://api.elevenlabs.io/v1/flows/text-to-speech
Content-Type: application/json

Starta en talgenerering med den valda modellen. Debiteras per tecken via fakturering för text-till-tal. Använd detta i stället för `/v1/text-to-speech` för den asynkrona genereringslivscykeln eller för modeller som inte erbjuds där. För direkt, synkron talsyntes bör du använda `/v1/text-to-speech`.

Reference: https://elevenlabs.io/docs/api-reference/flows/text-to-speech/create

## Servers

- `https://api.elevenlabs.io` (Production, default)
- `https://api.us.elevenlabs.io` (Production US)
- `https://api.eu.residency.elevenlabs.io` (Production EU)
- `https://api.in.residency.elevenlabs.io` (Production India)
- `https://api.sg.residency.elevenlabs.io` (Production Singapore)

## Request

### Body (application/json)

This endpoint expects a TextToSpeechGenerationRequest.

- `TextToSpeechGenerationRequest`
  - `model_id`: `eleven_flash_v2_5` (ElevenFlashV2_5Request)
    - `text` (string, required) — Texten som ska syntetiseras till tal.
    - `voice` (string, required) — ID:t för rösten att tala med.
    - `language_code` (string, optional, nullable) — ISO 639-1-språkkod som ska tillämpas på utdata. Utelämna för att identifiera språket från texten.
    - `output_format` (enum, optional, default: mp3_44100_128) — Ljudkodningen för utdata, som `codec_sampleRateHz_bitrateKbps`. `mp3_44100_192` kräver Creator-nivån eller högre.
      - Allowed values: `mp3_22050_32`, `mp3_24000_48`, `mp3_44100_32`, `mp3_44100_64`, `mp3_44100_96`, `mp3_44100_128`, `mp3_44100_192`
    - `pronunciation_dictionary_locators` (list of PronunciationDictionaryVersionLocator, optional) — Uttalsordlistor som ska tillämpas på texten, i prioritetsordning. Upp till 3.
    - `voice_settings` (ElevenFlashV2_5VoiceSettings, optional, nullable) — Åsidosättningar av röstens sparade inställningar, som endast tillämpas på denna generering.
    - `webhook` (WebhookTarget, optional, nullable) — Inkludera för att skicka genereringens resultat till arbetsytans konfigurerade flows-webhooks när den slutförs eller misslyckas. Webhook-payloaden motsvarar det slutliga svaret från motsvarande GET-endpoint.
  - `model_id`: `eleven_multilingual_v2` (ElevenMultilingualV2Request)
    - `text` (string, required) — Texten som ska syntetiseras till tal.
    - `voice` (string, required) — ID:t för rösten att tala med.
    - `output_format` (enum, optional, default: mp3_44100_128) — Ljudkodningen för utdata, som `codec_sampleRateHz_bitrateKbps`. `mp3_44100_192` kräver Creator-nivån eller högre.
      - Allowed values: `mp3_22050_32`, `mp3_24000_48`, `mp3_44100_32`, `mp3_44100_64`, `mp3_44100_96`, `mp3_44100_128`, `mp3_44100_192`
    - `pronunciation_dictionary_locators` (list of PronunciationDictionaryVersionLocator, optional) — Uttalsordlistor som ska tillämpas på texten, i prioritetsordning. Upp till 3.
    - `voice_settings` (TtsVoiceSettings, optional, nullable) — Åsidosättningar av röstens sparade inställningar, som endast tillämpas på denna generering.
    - `webhook` (WebhookTarget, optional, nullable) — Inkludera för att skicka genereringens resultat till arbetsytans konfigurerade flows-webhooks när den slutförs eller misslyckas. Webhook-payloaden motsvarar det slutliga svaret från motsvarande GET-endpoint.
  - `model_id`: `eleven_v3` (ElevenV3Request)
    - `text` (string, required) — Texten som ska syntetiseras till tal.
    - `voice` (string, required) — ID:t för rösten att tala med.
    - `language_code` (string, optional, nullable) — ISO 639-1-språkkod som ska tillämpas på utdata. Utelämna för att identifiera språket från texten.
    - `output_format` (enum, optional, default: mp3_44100_128) — Ljudkodningen för utdata, som `codec_sampleRateHz_bitrateKbps`. `mp3_44100_192` kräver Creator-nivån eller högre.
      - Allowed values: `mp3_22050_32`, `mp3_24000_48`, `mp3_44100_32`, `mp3_44100_64`, `mp3_44100_96`, `mp3_44100_128`, `mp3_44100_192`
    - `pronunciation_dictionary_locators` (list of PronunciationDictionaryVersionLocator, optional) — Uttalsordlistor som ska tillämpas på texten, i prioritetsordning. Upp till 3.
    - `voice_settings` (ElevenV3VoiceSettings, optional, nullable) — Åsidosättningar av röstens sparade inställningar, som endast tillämpas på denna generering.
    - `webhook` (WebhookTarget, optional, nullable) — Inkludera för att skicka genereringens resultat till arbetsytans konfigurerade flows-webhooks när den slutförs eller misslyckas. Webhook-payloaden motsvarar det slutliga svaret från motsvarande GET-endpoint.

## Response

### 200

Lyckat svar

- `id` (string, required) — Den unika identifieraren för genereringen. Skicka den till motsvarande GET-slutpunkt för att hämta utdata.
- `status` ("pending", required) — En nyligen skapad generering har alltid statusen `pending`.

## Errors

### 422 Unprocessable Entity Error

Valideringsfel

- `detail` (list of ValidationError, optional)

## Types

### PronunciationDictionaryVersionLocator

Ett uttalslexikon som ska användas vid talsyntes.

- `pronunciation_dictionary_id` (string, required) — ID:t för en uttalsordlista som skapats via `POST /v1/pronunciation-dictionaries/add-from-file` eller `POST /v1/pronunciation-dictionaries/add-from-rules`.
- `version_id` (string, optional, nullable) — Versionen av ordboken som ska användas. Utelämna för att använda den senaste versionen.

### ElevenFlashV2_5VoiceSettings

Åsidosättningar av röstens sparade inställningar, som tillämpas på en generering.

- `stability` (double, optional, nullable) — Hur konsekvent rösten förblir mellan genereringar. Lägre värden ger mer uttrycksfullt och varierat tal.
- `similarity_boost` (double, optional, nullable) — Hur nära resultatet följer originalrösten.
- `speed` (double, optional, nullable) — Hastigheten på det genererade talet, där 1,0 är röstens naturliga tempo.

### WebhookTarget

- `type`: `all` (WebhookTargetAll)
- `type`: `ids` (WebhookTargetIds)
  - `ids` (list of string, required) — ID:n för arbetsytans Flows-webhooks som resultatet ska levereras till. Varje webhook måste vara en av arbetsytans konfigurerade Flows-webhooks.

### TtsVoiceSettings

Åsidosättningar av röstens sparade inställningar, som tillämpas på en generering.

- `stability` (double, optional, nullable) — Hur konsekvent rösten förblir mellan genereringar. Lägre värden ger mer uttrycksfullt och varierat tal.
- `similarity_boost` (double, optional, nullable) — Hur nära resultatet följer originalrösten.
- `style` (double, optional, nullable) — Hur mycket talstilen överdrivs.
- `use_speaker_boost` (boolean, optional, nullable) — Om likheten med den ursprungliga talaren ska förstärkas, på bekostnad av viss latens.
- `speed` (double, optional, nullable) — Hastigheten på det genererade talet, där 1,0 är röstens naturliga tempo.

### ElevenV3VoiceSettings

Åsidosättningar av röstens sparade inställningar, som tillämpas på en generering.

- `stability` (double, optional, nullable) — Hur konsekvent rösten förblir mellan genereringar. Lägre värden ger mer uttrycksfullt och varierat tal.

### ValidationError

- `loc` (list of ValidationErrorLocItems, required)
- `msg` (string, required)
- `type` (string, required)

### ValidationErrorLocItems

## Examples

**Request**

```json
{
  "model_id": "string",
  "text": "The first move is what sets everything in motion.",
  "voice": "JBFqnCBsd6RMkjVDRZzb"
}
```

**Response**

```json
{
  "id": "JWr5N6X9ZTqf8jD2LmQb",
  "status": "pending"
}
```

**SDK Code**

```python
import requests

url = "https://api.elevenlabs.io/v1/flows/text-to-speech"

payload = {
    "model_id": "string",
    "text": "The first move is what sets everything in motion.",
    "voice": "JBFqnCBsd6RMkjVDRZzb"
}
headers = {"Content-Type": "application/json"}

response = requests.post(url, json=payload, headers=headers)

print(response.json())
```

```javascript
const url = 'https://api.elevenlabs.io/v1/flows/text-to-speech';
const options = {
  method: 'POST',
  headers: {'Content-Type': 'application/json'},
  body: '{"model_id":"string","text":"The first move is what sets everything in motion.","voice":"JBFqnCBsd6RMkjVDRZzb"}'
};

try {
  const response = await fetch(url, options);
  const data = await response.json();
  console.log(data);
} catch (error) {
  console.error(error);
}
```

```go
package main

import (
	"fmt"
	"strings"
	"net/http"
	"io"
)

func main() {

	url := "https://api.elevenlabs.io/v1/flows/text-to-speech"

	payload := strings.NewReader("{\n  \"model_id\": \"string\",\n  \"text\": \"The first move is what sets everything in motion.\",\n  \"voice\": \"JBFqnCBsd6RMkjVDRZzb\"\n}")

	req, _ := http.NewRequest("POST", url, payload)

	req.Header.Add("Content-Type", "application/json")

	res, _ := http.DefaultClient.Do(req)

	defer res.Body.Close()
	body, _ := io.ReadAll(res.Body)

	fmt.Println(res)
	fmt.Println(string(body))

}
```

```ruby
require 'uri'
require 'net/http'

url = URI("https://api.elevenlabs.io/v1/flows/text-to-speech")

http = Net::HTTP.new(url.host, url.port)
http.use_ssl = true

request = Net::HTTP::Post.new(url)
request["Content-Type"] = 'application/json'
request.body = "{\n  \"model_id\": \"string\",\n  \"text\": \"The first move is what sets everything in motion.\",\n  \"voice\": \"JBFqnCBsd6RMkjVDRZzb\"\n}"

response = http.request(request)
puts response.read_body
```

```java
import com.mashape.unirest.http.HttpResponse;
import com.mashape.unirest.http.Unirest;

HttpResponse<String> response = Unirest.post("https://api.elevenlabs.io/v1/flows/text-to-speech")
  .header("Content-Type", "application/json")
  .body("{\n  \"model_id\": \"string\",\n  \"text\": \"The first move is what sets everything in motion.\",\n  \"voice\": \"JBFqnCBsd6RMkjVDRZzb\"\n}")
  .asString();
```

```php
<?php
require_once('vendor/autoload.php');

$client = new \GuzzleHttp\Client();

$response = $client->request('POST', 'https://api.elevenlabs.io/v1/flows/text-to-speech', [
  'body' => '{
  "model_id": "string",
  "text": "The first move is what sets everything in motion.",
  "voice": "JBFqnCBsd6RMkjVDRZzb"
}',
  'headers' => [
    'Content-Type' => 'application/json',
  ],
]);

echo $response->getBody();
```

```csharp
using RestSharp;

var client = new RestClient("https://api.elevenlabs.io/v1/flows/text-to-speech");
var request = new RestRequest(Method.POST);
request.AddHeader("Content-Type", "application/json");
request.AddParameter("application/json", "{\n  \"model_id\": \"string\",\n  \"text\": \"The first move is what sets everything in motion.\",\n  \"voice\": \"JBFqnCBsd6RMkjVDRZzb\"\n}", ParameterType.RequestBody);
IRestResponse response = client.Execute(request);
```

```swift
import Foundation

let headers = ["Content-Type": "application/json"]
let parameters = [
  "model_id": "string",
  "text": "The first move is what sets everything in motion.",
  "voice": "JBFqnCBsd6RMkjVDRZzb"
] as [String : Any]

let postData = JSONSerialization.data(withJSONObject: parameters, options: [])

let request = NSMutableURLRequest(url: NSURL(string: "https://api.elevenlabs.io/v1/flows/text-to-speech")! as URL,
                                        cachePolicy: .useProtocolCachePolicy,
                                    timeoutInterval: 10.0)
request.httpMethod = "POST"
request.allHTTPHeaderFields = headers
request.httpBody = postData as Data

let session = URLSession.shared
let dataTask = session.dataTask(with: request as URLRequest, completionHandler: { (data, response, error) -> Void in
  if (error != nil) {
    print(error as Any)
  } else {
    let httpResponse = response as? HTTPURLResponse
    print(httpResponse)
  }
})

dataTask.resume()
```