Presentiamo Scribe v2
- Pubblicato
AscoltaAscolta questo articolo
Scribe v2 è progettato per la trascrizione batch, la sottotitolazione e la creazione di didascalie su larga scala. Migliora la stabilità e l'accuratezza di Scribe v1, gestendo meglio audio di lunga durata, pause, cambi di tono e silenzi prolungati.

Mentre Scribe v2 Realtime è ottimizzato per una latenza ultra bassa e i casi d'uso degli agenti, Scribe v2 è ottimizzato per registrazioni lunghe e complesse e mantiene l'accuratezza con voci, accenti e stili espositivi diversi. Il risultato sono trascrizioni affidabili in un'ampia gamma di condizioni audio reali.
Scribe v2 ottiene il più basso tasso di errore sulle parole registrato nei benchmark di settore.

Prompting di termini chiave per trascrizioni sensibili al contesto
Il prompting di termini chiave va oltre il vocabolario personalizzato standard, perché usa il contesto della trascrizione. Seleziona fino a 100 parole o frasi e Scribe v2 stabilirà con precisione quando trascrivere questi termini. È quindi particolarmente adatto ad ambiti tecnici, nomi di brand e linguaggio specifico di settore.

Rilevamento integrato delle entità con timestamp precisi
Scribe v2 include il rilevamento nativo delle entità per l'analisi strutturata dell'audio.
Puoi selezionare fino a 56 categorie, tra cui informazioni personali identificabili, dati sanitari o dettagli di pagamento. Scribe v2 rileverà automaticamente queste occorrenze e i relativi timestamp esatti nella trascrizione, semplificando la revisione, l'oscuramento o l'elaborazione di informazioni sensibili su larga scala.
Scopri di più nella documentazione API: https://elevenlabs.io/docs/developers/guides/cookbooks/speech-to-text/batch/entity-detection
Trascrizione automatica multilingue
Scribe v2 supporta workflow multilingue intelligenti fin da subito.
Puoi inviare in un unico file audio che contiene più lingue. Il modello rileva automaticamente ogni lingua e la trascrive correttamente, senza segmentazione o configurazione manuale.
Funzionalità aggiuntive per i workflow di produzione
Scribe v2 include un insieme di funzionalità pensate per i casi d'uso enterprise e per gli sviluppatori:
- Diarizzazione intelligente dei parlanti per etichette chiare e intuitive
- Timestamp precisi a livello di parola per un allineamento accurato dei sottotitoli e esperienze interattive
- Tag audio dinamici che rilevano eventi non vocali, come risate o passi
- Pronto per l'uso enterprise, con conformità a SOC 2, ISO 27001, PCI DSS L1, HIPAA e GDPR, residenza dei dati nell'UE e in India e supporto per la modalità a conservazione zero
Scribe v2, ora in ElevenLabs Studio
Scribe v2 è ora utilizzato in ElevenLabs Studio per sottotitoli, didascalie e trascrizioni più accurate, aiutando i team che gestiscono grandi librerie di audio e video per marketing, media, ricerca, formazione e conformità normativa.

Provalo ora: https://elevenlabs.io/app/studio
Sviluppa con l'API
Con Scribe v2, sviluppatori e aziende possono automatizzare pipeline audio complesse, migliorare l'accuratezza nei workflow di contenuti globali e scalare in sicurezza con controlli completi di conformità normativa e residenza dei dati.

Scribe v2 è disponibile da oggi tramite la nostra API e la piattaforma Creative.
Provalo ora: https://elevenlabs.io/app/speech-to-text
Leggi la documentazione: https://elevenlabs.io/docs/capabilities/speech-to-text
Registrati qui: https://elevenlabs.io/speech-to-text




