Présentation de Scribe v2
- Publié
ÉcouterÉcouter cet article
Scribe v2 est conçu pour la transcription par lots, le sous-titrage et le sous-titrage codé à grande échelle. Il améliore la stabilité et la précision de Scribe v1, avec une meilleure gestion des contenus audio longs, des pauses, des changements de ton et des silences prolongés.

Alors que Scribe v2 Realtime est optimisé pour une latence ultra-faible et les cas d'usage des agents, Scribe v2 est optimisé pour les enregistrements longs et complexes, en préservant sa précision face à des intervenants, accents et styles d'élocution variés. Résultat : des transcriptions fiables dans un large éventail de conditions audio réelles.
Scribe v2 atteint le taux d'erreur sur les mots le plus faible jamais enregistré dans les benchmarks de référence du secteur.

Keyterm Prompting pour une transcription contextualisée
Le Keyterm Prompting va au-delà du Custom Vocabulary standard en exploitant le contexte de la transcription. Sélectionnez jusqu'à 100 mots ou expressions, et Scribe v2 déterminera avec précision à quel moment les transcrire. Cette fonctionnalité est particulièrement adaptée aux domaines techniques, aux noms de marque et au vocabulaire propre à chaque secteur.

Détection d'entités intégrée avec horodatage précis
Scribe v2 intègre une détection d'entités native pour l'analyse audio structurée.
Vous pouvez sélectionner jusqu'à 56 catégories, parmi lesquelles les informations personnelles identifiables, les données de santé ou les informations de paiement. Scribe v2 détecte automatiquement ces occurrences et leurs horodatages précis dans votre transcription, afin de faciliter l'examen, la suppression ou le traitement des informations sensibles à grande échelle.
En savoir plus dans la documentation de l'API : https://elevenlabs.io/docs/developers/guides/cookbooks/speech-to-text/batch/entity-detection
Transcription automatique multilingue
Scribe v2 prend en charge nativement des workflows multilingues intelligents.
Vous pouvez envoyer un fichier audio contenant plusieurs langues. Le modèle détecte automatiquement chaque langue et la transcrit correctement, sans segmentation ni configuration manuelle.
Fonctionnalités supplémentaires pour les workflows de production
Scribe v2 intègre un ensemble de fonctionnalités conçues pour les cas d'usage des entreprises et des développeurs :
- Diarisation intelligente des intervenants pour une identification claire et intuitive
- Horodatage précis au niveau du mot pour un alignement exact des sous-titres et des expériences interactives
- Balisage audio dynamique qui détecte les événements non vocaux, comme les rires ou les bruits de pas
- Prêt pour les entreprises, avec la conformité SOC 2, ISO 27001, PCI DSS L1, HIPAA et RGPD, la résidence des données européenne et en Inde, ainsi que la prise en charge du mode zéro rétention
Scribe v2, désormais dans ElevenLabs Studio
Scribe v2 est désormais utilisé dans ElevenLabs Studio pour des sous-titres, sous-titres codés et transcriptions plus précis. Il accompagne les équipes qui gèrent d'importantes bibliothèques audio et vidéo pour le marketing, les médias, la recherche, la formation et la conformité.

Essayez-le dès maintenant : https://elevenlabs.io/app/studio
Développez avec l'API
Avec Scribe v2, les développeurs et les entreprises peuvent automatiser des pipelines audio complexes, améliorer la précision des workflows de contenu internationaux et monter en charge de façon sécurisée, avec des contrôles complets de conformité et de résidence des données.

Scribe v2 est disponible dès aujourd'hui via notre API et la plateforme Creative.
Essayez-le dès maintenant : https://elevenlabs.io/app/speech-to-text
En savoir plus dans la documentation : https://elevenlabs.io/docs/capabilities/speech-to-text
S'inscrire ici : https://elevenlabs.io/speech-to-text




