> This is a page from the ElevenLabs documentation. For a complete page index, fetch https://elevenlabs.io/docs/llms.txt. For the full documentation in a single file, fetch https://elevenlabs.io/docs/llms-full.txt.

# Cos'è Speech to Text?

Speech to Text converte l'audio parlato in testo scritto. In ElevenLabs, il nostro modello Speech to Text è **Scribe**. Ti consente di trascrivere accuratamente il parlato in oltre 90 lingue, trasformando facilmente l'audio in testo leggibile e ricercabile.

#### **Funzionalità principali di Scribe**

* Accuratezza leader nel settore, con un'accuratezza del 98% nelle principali lingue come inglese, francese, italiano, portoghese, spagnolo e tedesco.
* Timestamp precisi a livello di parola, per vedere esattamente quando viene pronunciata ogni parola.
* Diarizzazione intelligente degli interlocutori, che identifica e separa automaticamente i diversi interlocutori.
* Tag audio dinamici per rilevare suoni non vocali.
* Supporto fino a 32 interlocutori mantenendo un'elevata accuratezza.

## **Novità di Scribe v2**

Scribe v2 si basa sul modello principale con funzionalità aggiuntive progettate per casi d'uso più complessi.

* **Prompting con termini chiave**. Puoi fornire fino a 100 parole o frasi per guidare il modello
  a trascrivere correttamente i termini importanti. L'uso del prompting con termini chiave aumenta il costo del 20%.
* **Rilevamento delle entità**. Puoi scegliere categorie specifiche di informazioni da rilevare
  nella trascrizione, come numeri di carte di credito, nomi o condizioni mediche. Il rilevamento delle entità è
  disponibile solo tramite API e aumenta il costo del 30%.
* **Supporto intelligente per più lingue**. Puoi inviare audio contenente più lingue
  e Scribe v2 rileverà e trascriverà automaticamente ciascuna in modo corretto.
* **Maggiore stabilità**. Scribe v2 gestisce pause, cambiamenti di tono e silenzi prolungati
  senza interrompersi né perdere accuratezza.

  \


#### **Quale versione dovresti usare?**

Ti consigliamo **Scribe v2** quando è necessaria una trascrizione ad alta accuratezza. È disponibile sul nostro [sito web](https://elevenlabs.io/app/speech-to-text) e tramite [API](/docs/it/api-reference/speech-to-text/convert). Quando usi Speech to Text tramite il nostro sito web, Scribe v2 è il modello predefinito.

Per l'audio medico e clinico, usa **Scribe v2 Medical** (`scribe_v2_medical`) tramite la stessa API. Viene fatturato alla stessa tariffa di Scribe v2.

Per i casi d'uso in tempo reale, consigliamo **Scribe v2 Realtime**, disponibile tramite [ElevenAgents](https://elevenlabs.io/app/agents) e via [API](/docs/it/api-reference/speech-to-text/convert).

Per maggiori dettagli, consulta la nostra [documentazione Speech to Text.](/docs/it/capabilities/speech-to-text)