Vai al contenuto

Presentiamo Scribe v2

Pubblicato

AscoltaAscolta questo articolo

Scribe v2 è progettato per la trascrizione in batch, la sottotitolazione e la creazione di didascalie su larga scala. Migliora la stabilità e l'accuratezza di Scribe v1, gestendo meglio audio di lunga durata, pause, cambi di tono e silenzi prolungati.

Introducing Scribe v2

Mentre Scribe v2 Realtime è ottimizzato per una latenza estremamente bassa e i casi d'uso degli agenti, Scribe v2 è ottimizzato per registrazioni lunghe e complesse e mantiene un'elevata accuratezza con voci, accenti e stili espressivi diversi. Il risultato sono trascrizioni affidabili in modo costante, in un'ampia varietà di condizioni audio reali.


Scribe v2 raggiunge il più basso tasso di errore sulle parole mai registrato nei benchmark standard del settore.

Scribe v2 FLEURS benchmark

Keyterm Prompting per trascrizioni basate sul contesto

Il Keyterm Prompting va oltre il Custom Vocabulary standard perché utilizza il contesto della trascrizione. Seleziona fino a 100 parole o frasi e Scribe v2 stabilirà con precisione quando trascrivere questi termini. È quindi ideale per ambiti tecnici, nomi di brand e linguaggio specifico di settore.

Scribe v2 keyterm prompting

Rilevamento integrato delle entità con timestamp precisi

Scribe v2 include il rilevamento nativo delle entità per l'analisi strutturata dell'audio.

Puoi selezionare fino a 56 categorie, tra cui informazioni di identificazione personale, dati sanitari o dettagli di pagamento. Scribe v2 rileverà automaticamente queste occorrenze e i relativi timestamp esatti nella trascrizione, semplificando la revisione, l'oscuramento o l'elaborazione di informazioni sensibili su larga scala.

Scopri di più nella documentazione API: https://elevenlabs.io/docs/developers/guides/cookbooks/speech-to-text/batch/entity-detection

Trascrizione automatica multilingue

Scribe v2 supporta fin da subito workflow intelligenti multilingue.

Puoi inviare un file audio che contiene più lingue. Il modello rileva automaticamente ogni lingua e la trascrive correttamente, senza segmentazione o configurazione manuale.

Funzionalità aggiuntive per workflow di produzione

Scribe v2 include una serie di funzionalità progettate per casi d'uso aziendali e per sviluppatori:

  • Diarizzazione intelligente dei parlanti per identificare i parlanti in modo chiaro e intuitivo
  • Timestamp precisi a livello di parola per un allineamento accurato dei sottotitoli e per esperienze interattive
  • Tag audio dinamici che rilevano eventi non verbali, come risate o passi
  • Pronto per le aziende, con conformità a SOC 2, ISO 27001, PCI DSS L1, HIPAA e GDPR, residenza dei dati nell'UE e in India e supporto della modalità a conservazione zero

Scribe v2, ora in ElevenLabs Studio

Scribe v2 è ora disponibile in ElevenLabs Studio per sottotitoli, didascalie e trascrizioni più accurate e supporta i team che gestiscono ampie librerie di audio e video per marketing, media, ricerca, formazione e conformità normativa.

Scribe v2 in Studio

Provalo ora: https://elevenlabs.io/app/studio

Sviluppa con l'API

Con Scribe v2, sviluppatori e aziende possono automatizzare pipeline audio complesse, migliorare l'accuratezza nei workflow di contenuti globali e scalare in sicurezza con controlli completi di conformità normativa e residenza dei dati.

Scribe v2 Keyterm prompting code snippet

Scribe v2 è disponibile da oggi tramite la nostra API e la piattaforma Creative.

Provalo ora: https://elevenlabs.io/app/speech-to-text

Leggi la documentazione: https://elevenlabs.io/docs/capabilities/speech-to-text

Registrati qui: https://elevenlabs.io/speech-to-text

Articoli simili

Crea con l'audio IA della massima qualità