Présentation de Scribe v2
- Publié
ÉcouterÉcouter cet article
Scribe v2 est conçu pour la transcription, le sous-titrage et le titrage par lots à grande échelle. Il améliore la stabilité et la précision de Scribe v1, avec une meilleure gestion des contenus audio longs, des pauses, des changements de ton et des silences prolongés.

Alors que Scribe v2 Realtime est optimisé pour une latence ultra-faible et les cas d’usage d’agents, Scribe v2 est optimisé pour les enregistrements longs et complexes. Il maintient sa précision auprès de locuteurs, d’accents et de styles d’élocution variés. Résultat : des transcriptions fiables dans un large éventail de conditions audio réelles.
Scribe v2 atteint le plus faible taux d’erreur de mots enregistré sur les benchmarks de référence du secteur.

Prompting par termes clés pour une transcription contextuelle
Le prompting par termes clés va au-delà de Custom Vocabulary standard en exploitant le contexte de la transcription. Sélectionnez jusqu’à 100 mots ou expressions : Scribe v2 détermine précisément quand les transcrire. Cette fonctionnalité est particulièrement adaptée aux domaines techniques, aux noms de marques et au vocabulaire propre à chaque secteur.

Détection intégrée des entités avec horodatage précis
Scribe v2 intègre une détection native des entités pour l’analyse audio structurée.
Vous pouvez sélectionner jusqu’à 56 catégories, notamment les données personnelles identifiables, les données de santé ou les informations de paiement. Scribe v2 détecte automatiquement ces éléments et leurs horodatages exacts dans votre transcription, afin de faciliter l’examen, le masquage ou le traitement des informations sensibles à grande échelle.
En savoir plus dans la documentation de l’API : https://elevenlabs.io/docs/developers/guides/cookbooks/speech-to-text/batch/entity-detection
Transcription multilingue automatique
Scribe v2 prend en charge nativement des workflows multilingues intelligents.
Envoyez un fichier audio contenant plusieurs langues. Le modèle détecte automatiquement chaque langue et la transcrit correctement, sans segmentation ni configuration manuelle.
Fonctionnalités supplémentaires pour les workflows de production
Scribe v2 inclut un ensemble de fonctionnalités conçues pour les cas d’usage des entreprises et des développeurs :
- Diarisation intelligente des locuteurs pour une identification claire et intuitive
- Horodatage précis au niveau du mot pour un alignement fiable des sous-titres et des expériences interactives
- Étiquetage audio dynamique qui détecte les événements non vocaux, tels que les rires ou les bruits de pas
- Prêt pour l’entreprise : conformité SOC 2, ISO 27001, PCI DSS L1, HIPAA et RGPD, hébergement des données en Europe et en Inde, et prise en charge du mode sans conservation des données
Scribe v2, désormais dans ElevenLabs Studio
Scribe v2 est désormais utilisé dans ElevenLabs Studio pour des sous-titres, titres et transcriptions plus précis. Il accompagne les équipes qui gèrent d’importantes bibliothèques audio et vidéo pour le marketing, les médias, la recherche, la formation et la conformité.

Essayez dès maintenant : https://elevenlabs.io/app/studio
Développez avec l’API
Avec Scribe v2, les développeurs et les entreprises peuvent automatiser des pipelines audio complexes, améliorer la précision des workflows de contenu internationaux et évoluer en toute sécurité grâce à des contrôles complets de conformité et de résidence des données.

Scribe v2 est disponible dès aujourd’hui via notre API et notre plateforme Creative.
Essayez dès maintenant : https://elevenlabs.io/app/speech-to-text
Lire la documentation : https://elevenlabs.io/docs/capabilities/speech-to-text
Inscrivez-vous ici : https://elevenlabs.io/speech-to-text




