Vai al contenuto

Presentiamo Scribe v2

Pubblicato

AscoltaAscolta questo articolo

Scribe v2 è progettato per la trascrizione batch, la sottotitolazione e la creazione di didascalie su larga scala. Migliora la stabilità e l'accuratezza di Scribe v1, gestendo meglio audio di lunga durata, pause, cambi di tono e silenzi prolungati.

Introducing Scribe v2

Mentre Scribe v2 Realtime è ottimizzato per una latenza ultra bassa e i casi d'uso degli agenti, Scribe v2 è ottimizzato per registrazioni lunghe e complesse e mantiene l'accuratezza con voci, accenti e stili espositivi diversi. Il risultato sono trascrizioni affidabili in un'ampia gamma di condizioni audio reali.


Scribe v2 ottiene il più basso tasso di errore sulle parole registrato nei benchmark di settore.

Scribe v2 FLEURS benchmark

Prompting di termini chiave per trascrizioni sensibili al contesto

Il prompting di termini chiave va oltre il vocabolario personalizzato standard, perché usa il contesto della trascrizione. Seleziona fino a 100 parole o frasi e Scribe v2 stabilirà con precisione quando trascrivere questi termini. È quindi particolarmente adatto ad ambiti tecnici, nomi di brand e linguaggio specifico di settore.

Scribe v2 keyterm prompting

Rilevamento integrato delle entità con timestamp precisi

Scribe v2 include il rilevamento nativo delle entità per l'analisi strutturata dell'audio.

Puoi selezionare fino a 56 categorie, tra cui informazioni personali identificabili, dati sanitari o dettagli di pagamento. Scribe v2 rileverà automaticamente queste occorrenze e i relativi timestamp esatti nella trascrizione, semplificando la revisione, l'oscuramento o l'elaborazione di informazioni sensibili su larga scala.

Scopri di più nella documentazione API: https://elevenlabs.io/docs/developers/guides/cookbooks/speech-to-text/batch/entity-detection

Trascrizione automatica multilingue

Scribe v2 supporta workflow multilingue intelligenti fin da subito.

Puoi inviare in un unico file audio che contiene più lingue. Il modello rileva automaticamente ogni lingua e la trascrive correttamente, senza segmentazione o configurazione manuale.

Funzionalità aggiuntive per i workflow di produzione

Scribe v2 include un insieme di funzionalità pensate per i casi d'uso enterprise e per gli sviluppatori:

  • Diarizzazione intelligente dei parlanti per etichette chiare e intuitive
  • Timestamp precisi a livello di parola per un allineamento accurato dei sottotitoli e esperienze interattive
  • Tag audio dinamici che rilevano eventi non vocali, come risate o passi
  • Pronto per l'uso enterprise, con conformità a SOC 2, ISO 27001, PCI DSS L1, HIPAA e GDPR, residenza dei dati nell'UE e in India e supporto per la modalità a conservazione zero

Scribe v2, ora in ElevenLabs Studio

Scribe v2 è ora utilizzato in ElevenLabs Studio per sottotitoli, didascalie e trascrizioni più accurate, aiutando i team che gestiscono grandi librerie di audio e video per marketing, media, ricerca, formazione e conformità normativa.

Scribe v2 in Studio

Provalo ora: https://elevenlabs.io/app/studio

Sviluppa con l'API

Con Scribe v2, sviluppatori e aziende possono automatizzare pipeline audio complesse, migliorare l'accuratezza nei workflow di contenuti globali e scalare in sicurezza con controlli completi di conformità normativa e residenza dei dati.

Scribe v2 Keyterm prompting code snippet

Scribe v2 è disponibile da oggi tramite la nostra API e la piattaforma Creative.

Provalo ora: https://elevenlabs.io/app/speech-to-text

Leggi la documentazione: https://elevenlabs.io/docs/capabilities/speech-to-text

Registrati qui: https://elevenlabs.io/speech-to-text

Articoli simili

Crea con l'audio IA della massima qualità