Presentiamo Scribe v2
- Pubblicato
AscoltaAscolta questo articolo
Scribe v2 è progettato per la trascrizione in batch, la sottotitolazione e la creazione di didascalie su larga scala. Migliora la stabilità e l'accuratezza di Scribe v1, gestendo meglio audio di lunga durata, pause, cambi di tono e silenzi prolungati.

Mentre Scribe v2 Realtime è ottimizzato per una latenza estremamente bassa e i casi d'uso degli agenti, Scribe v2 è ottimizzato per registrazioni lunghe e complesse e mantiene un'elevata accuratezza con voci, accenti e stili espressivi diversi. Il risultato sono trascrizioni affidabili in modo costante, in un'ampia varietà di condizioni audio reali.
Scribe v2 raggiunge il più basso tasso di errore sulle parole mai registrato nei benchmark standard del settore.

Keyterm Prompting per trascrizioni basate sul contesto
Il Keyterm Prompting va oltre il Custom Vocabulary standard perché utilizza il contesto della trascrizione. Seleziona fino a 100 parole o frasi e Scribe v2 stabilirà con precisione quando trascrivere questi termini. È quindi ideale per ambiti tecnici, nomi di brand e linguaggio specifico di settore.

Rilevamento integrato delle entità con timestamp precisi
Scribe v2 include il rilevamento nativo delle entità per l'analisi strutturata dell'audio.
Puoi selezionare fino a 56 categorie, tra cui informazioni di identificazione personale, dati sanitari o dettagli di pagamento. Scribe v2 rileverà automaticamente queste occorrenze e i relativi timestamp esatti nella trascrizione, semplificando la revisione, l'oscuramento o l'elaborazione di informazioni sensibili su larga scala.
Scopri di più nella documentazione API: https://elevenlabs.io/docs/developers/guides/cookbooks/speech-to-text/batch/entity-detection
Trascrizione automatica multilingue
Scribe v2 supporta fin da subito workflow intelligenti multilingue.
Puoi inviare un file audio che contiene più lingue. Il modello rileva automaticamente ogni lingua e la trascrive correttamente, senza segmentazione o configurazione manuale.
Funzionalità aggiuntive per workflow di produzione
Scribe v2 include una serie di funzionalità progettate per casi d'uso aziendali e per sviluppatori:
- Diarizzazione intelligente dei parlanti per identificare i parlanti in modo chiaro e intuitivo
- Timestamp precisi a livello di parola per un allineamento accurato dei sottotitoli e per esperienze interattive
- Tag audio dinamici che rilevano eventi non verbali, come risate o passi
- Pronto per le aziende, con conformità a SOC 2, ISO 27001, PCI DSS L1, HIPAA e GDPR, residenza dei dati nell'UE e in India e supporto della modalità a conservazione zero
Scribe v2, ora in ElevenLabs Studio
Scribe v2 è ora disponibile in ElevenLabs Studio per sottotitoli, didascalie e trascrizioni più accurate e supporta i team che gestiscono ampie librerie di audio e video per marketing, media, ricerca, formazione e conformità normativa.

Provalo ora: https://elevenlabs.io/app/studio
Sviluppa con l'API
Con Scribe v2, sviluppatori e aziende possono automatizzare pipeline audio complesse, migliorare l'accuratezza nei workflow di contenuti globali e scalare in sicurezza con controlli completi di conformità normativa e residenza dei dati.

Scribe v2 è disponibile da oggi tramite la nostra API e la piattaforma Creative.
Provalo ora: https://elevenlabs.io/app/speech-to-text
Leggi la documentazione: https://elevenlabs.io/docs/capabilities/speech-to-text
Registrati qui: https://elevenlabs.io/speech-to-text




