> This is a page from the ElevenLabs documentation. For a complete page index, fetch https://elevenlabs.io/docs/llms.txt. For the full documentation in a single file, fetch https://elevenlabs.io/docs/llms-full.txt.

# Modifica della trascrizione

> **Note**
>
> **Guida pratica** · Presuppone che tu abbia completato la [guida rapida di Speech to Text ](/docs/it/eleven-api/guides/cookbooks/speech-to-text).

## Panoramica

> **Warning**
>
> La modifica della trascrizione è una funzionalità sperimentale e comporta un costo aggiuntivo del 30% rispetto al
> costo base della trascrizione, fatturato per un minimo di 10 secondi di audio per richiesta. Consulta la [pagina dei prezzi delle API ](https://elevenlabs.io/pricing?price.section=speech_to_text\&price.sections=speech_to_text,speech_to_text#pricing-table)
> per informazioni dettagliate sui prezzi.

La modifica della trascrizione ti consente di allegare un'istruzione in linguaggio naturale a una richiesta di trascrizione. Dopo che l'audio è stato trascritto, l'istruzione viene applicata alla trascrizione e il testo modificato viene restituito insieme all'originale.

Questo sostituisce una fase di post-elaborazione separata nella tua pipeline. Gli utilizzi tipici includono la normalizzazione della scrittura di date, orari o unità, l'espansione delle abbreviazioni, la rimozione di contenuti non necessari, l'applicazione di uno stile o tono diverso oppure la riformattazione della trascrizione.

Ad esempio, la trascrizione di un messaggio vocale con l'istruzione `Write all dates in ISO 8601 format (YYYY-MM-DD)` restituisce entrambe le versioni del testo:

```json maxLines=0
{
  "language_code": "eng",
  "language_probability": 0.9912,
  "text": "Hi, this is Jill. Your appointment is confirmed for the twelfth of July twenty twenty-six, and the follow-up is on the third of August.",
  "words": [
    { "text": "Hi,", "start": 0.12, "end": 0.38, "type": "word", "logprob": 0.0 },
    { "text": " ", "start": 0.38, "end": 0.41, "type": "spacing", "logprob": 0.0 },
    { "text": "this", "start": 0.41, "end": 0.55, "type": "word", "logprob": 0.0 },
    ...
  ],
  "transcription_id": "Y2ZX8AxHUzTPCIualYiE",
  "edited_transcript": {
    "kind": "transcript",
    "text": "Hi, this is Jill. Your appointment is confirmed for 2026-07-12, and the follow-up is on 2026-08-03."
  }
}
```

I campi `text` e `words` descrivono sempre la trascrizione originale. La versione modificata viene restituita separatamente in `edited_transcript`.

## Integrare la modifica della trascrizione

La modifica della trascrizione è integrata nell'API Speech to Text passando il parametro `transcript_edit` al metodo `convert`. L'istruzione può contenere fino a 2000 caratteri.

```python maxLines=0
import os
from dotenv import load_dotenv
from elevenlabs.client import ElevenLabs

load_dotenv()

elevenlabs = ElevenLabs(
    api_key=os.getenv("ELEVENLABS_API_KEY"),
)

with open("voicemail.mp3", "rb") as audio_file:
    transcription = elevenlabs.speech_to_text.convert(
        file=audio_file,
        model_id="scribe_v2",
        # Natural-language instruction applied to the finished transcript.
        transcript_edit="Write all dates in ISO 8601 format (YYYY-MM-DD)",
    )

print("Original:", transcription.text)
print("Edited:", transcription.edited_transcript)
```

```typescript maxLines=0
import { ElevenLabsClient } from "@elevenlabs/elevenlabs-js";
import "dotenv/config";
import { readFile } from "node:fs/promises";

const elevenlabs = new ElevenLabsClient({
  apiKey: process.env.ELEVENLABS_API_KEY,
});

const audioBlob = new Blob([await readFile("voicemail.mp3")], { type: "audio/mp3" });

const transcription = await elevenlabs.speechToText.convert({
  file: audioBlob,
  modelId: "scribe_v2",
  // Natural-language instruction applied to the finished transcript.
  transcriptEdit: "Write all dates in ISO 8601 format (YYYY-MM-DD)",
});

console.log("Original:", transcription.text);
console.log("Edited:", transcription.editedTranscript);
```

La modifica della trascrizione funziona sia con richieste sincrone sia con richieste [webhook](/docs/it/eleven-api/guides/how-to/speech-to-text/batch/webhooks). Per le richieste webhook, `edited_transcript` è incluso nell'oggetto `transcription` del payload del webhook.

Scribe v2 Realtime supporta le stesse istruzioni per ogni trascrizione confermata. Consulta la [guida alla modifica delle trascrizioni in tempo reale](/docs/it/eleven-api/guides/how-to/speech-to-text/realtime/transcript-editing).

## Scrivere istruzioni

L'istruzione viene applicata all'intera trascrizione ovunque sia pertinente e ogni occorrenza corrispondente viene modificata, non solo la prima. Un'istruzione può modificare parole o frasi specifiche lasciando invariato tutto il resto, oppure può riscrivere o annotare il testo completo. Una singola istruzione può combinare più modifiche.

I seguenti esempi illustrano la gamma di istruzioni supportate:

| Istruzione                                                                                              | Effetto                                                                                  |
| ------------------------------------------------------------------------------------------------------- | ---------------------------------------------------------------------------------------- |
| `Write all dates in ISO 8601 format (YYYY-MM-DD)`                                                       | `the twelfth of July twenty twenty-six` diventa `2026-07-12`                             |
| `Write times in 24-hour format`                                                                         | `half past two in the afternoon` diventa `14:30`                                         |
| `Expand abbreviations such as "ETA" and "ASAP" on first use`                                            | `ETA` diventa `estimated time of arrival (ETA)`                                          |
| `Add the sentiment of every sentence in brackets at the end. Choose from [positive, negative, neutral]` | `Thanks, that was really helpful.` diventa `Thanks, that was really helpful. [positive]` |
| `Redact every curse word with its first letter followed by stars, e.g. s***`                            | `That was a damn good call.` diventa `That was a d*** good call.`                        |
| `Format the transcript as a bulleted list, one sentence per bullet`                                     | Riformatta l'intera trascrizione                                                         |

> **Note**
>
> Alcune modifiche dispongono di parametri dedicati più economici e prevedibili di un'istruzione di
> modifica. Usa il [keyterm prompting](/docs/it/eleven-api/guides/how-to/speech-to-text/batch/keyterm-prompting) per orientare il
> riconoscimento verso nomi e termini specifici, `no_verbatim` per rimuovere parole riempitive e
> disfluenze e `numbers_format` (dove supportato) per scegliere tra cifre e parole. Riserva la
> modifica della trascrizione ai cambiamenti che queste opzioni non coprono.

Tieni presente quanto segue quando scrivi le istruzioni:

* Sii esplicito sul risultato desiderato. `Write all dates in ISO 8601 format (YYYY-MM-DD)` è più affidabile di `fix the dates`.
* L'istruzione può essere scritta in qualsiasi lingua, anche se quelle scritte in inglese funzionano meglio. La trascrizione modificata rimane nella lingua dell'originale.
* Viene eseguita solo l'istruzione. Il contenuto pronunciato nell'audio viene trattato come dati e non può modificare l'applicazione dell'istruzione.
* Se l'istruzione non influisce su nulla nella trascrizione, la trascrizione modificata è identica all'originale.

## Formato della risposta

Quando è impostato `transcript_edit`, la risposta contiene un oggetto `edited_transcript`. Il campo `kind` indica se la modifica è riuscita:

| `kind`       | Campi                                   | Descrizione                                                                                                                    |
| ------------ | --------------------------------------- | ------------------------------------------------------------------------------------------------------------------------------ |
| `transcript` | `text`                                  | La trascrizione modificata. È identica al `text` originale quando non sono state apportate modifiche.                          |
| `error`      | `error_type` (`edit_failed`), `message` | Non è stato possibile produrre la modifica. La trascrizione è comunque riuscita e viene ancora restituito il `text` originale. |

Il campo è assente quando non è stato richiesto `transcript_edit`.

**`Modifica non riuscita`**

```json title="Modifica non riuscita"
{
  "text": "Hi, this is Jill. Your appointment is confirmed for ...",
  "edited_transcript": {
    "kind": "error",
    "error_type": "edit_failed",
    "message": "The transcript could not be edited. Please try again."
  }
}
```

Comportamenti da tenere presenti:

* La trascrizione modificata è testo semplice. I timestamp a livello di parola, le etichette dei parlanti e `additional_formats` continuano a descrivere la trascrizione originale.
* La modifica viene eseguita dopo il completamento della trascrizione, quindi aggiunge una latenza che aumenta con la lunghezza della trascrizione.
* Il supplemento viene applicato alla durata audio della richiesta, con un minimo di 10 secondi fatturati per richiesta.

> **Warning**
>
> La modifica della trascrizione non può essere combinata con `entity_detection`, `entity_redaction` o
> `use_multi_channel`. Le richieste che li combinano vengono rifiutate con un errore di parametri non validi.

## Passaggi successivi

#### [Riferimento API](/docs/it/api-reference/speech-to-text)

Riferimento completo dell'API Speech to Text e relativi parametri.

#### [Webhook](/docs/it/eleven-api/guides/how-to/speech-to-text/batch/webhooks)

Ricevi le trascrizioni, inclusa quella modificata, in modo asincrono tramite webhook.