Aller au contenu

Présentation de Scribe v2

Publié

ÉcouterÉcouter cet article

Scribe v2 est conçu pour la transcription, le sous-titrage et le titrage par lots à grande échelle. Il améliore la stabilité et la précision de Scribe v1, avec une meilleure gestion des contenus audio longs, des pauses, des changements de ton et des silences prolongés.

Introducing Scribe v2

Alors que Scribe v2 Realtime est optimisé pour une latence ultra-faible et les cas d’usage d’agents, Scribe v2 est optimisé pour les enregistrements longs et complexes. Il maintient sa précision auprès de locuteurs, d’accents et de styles d’élocution variés. Résultat : des transcriptions fiables dans un large éventail de conditions audio réelles.


Scribe v2 atteint le plus faible taux d’erreur de mots enregistré sur les benchmarks de référence du secteur.

Scribe v2 FLEURS benchmark

Prompting par termes clés pour une transcription contextuelle

Le prompting par termes clés va au-delà de Custom Vocabulary standard en exploitant le contexte de la transcription. Sélectionnez jusqu’à 100 mots ou expressions : Scribe v2 détermine précisément quand les transcrire. Cette fonctionnalité est particulièrement adaptée aux domaines techniques, aux noms de marques et au vocabulaire propre à chaque secteur.

Scribe v2 keyterm prompting

Détection intégrée des entités avec horodatage précis

Scribe v2 intègre une détection native des entités pour l’analyse audio structurée.

Vous pouvez sélectionner jusqu’à 56 catégories, notamment les données personnelles identifiables, les données de santé ou les informations de paiement. Scribe v2 détecte automatiquement ces éléments et leurs horodatages exacts dans votre transcription, afin de faciliter l’examen, le masquage ou le traitement des informations sensibles à grande échelle.

En savoir plus dans la documentation de l’API : https://elevenlabs.io/docs/developers/guides/cookbooks/speech-to-text/batch/entity-detection

Transcription multilingue automatique

Scribe v2 prend en charge nativement des workflows multilingues intelligents.

Envoyez un fichier audio contenant plusieurs langues. Le modèle détecte automatiquement chaque langue et la transcrit correctement, sans segmentation ni configuration manuelle.

Fonctionnalités supplémentaires pour les workflows de production

Scribe v2 inclut un ensemble de fonctionnalités conçues pour les cas d’usage des entreprises et des développeurs :

  • Diarisation intelligente des locuteurs pour une identification claire et intuitive
  • Horodatage précis au niveau du mot pour un alignement fiable des sous-titres et des expériences interactives
  • Étiquetage audio dynamique qui détecte les événements non vocaux, tels que les rires ou les bruits de pas
  • Prêt pour l’entreprise : conformité SOC 2, ISO 27001, PCI DSS L1, HIPAA et RGPD, hébergement des données en Europe et en Inde, et prise en charge du mode sans conservation des données

Scribe v2, désormais dans ElevenLabs Studio

Scribe v2 est désormais utilisé dans ElevenLabs Studio pour des sous-titres, titres et transcriptions plus précis. Il accompagne les équipes qui gèrent d’importantes bibliothèques audio et vidéo pour le marketing, les médias, la recherche, la formation et la conformité.

Scribe v2 in Studio

Essayez dès maintenant : https://elevenlabs.io/app/studio

Développez avec l’API

Avec Scribe v2, les développeurs et les entreprises peuvent automatiser des pipelines audio complexes, améliorer la précision des workflows de contenu internationaux et évoluer en toute sécurité grâce à des contrôles complets de conformité et de résidence des données.

Scribe v2 Keyterm prompting code snippet

Scribe v2 est disponible dès aujourd’hui via notre API et notre plateforme Creative.

Essayez dès maintenant : https://elevenlabs.io/app/speech-to-text

Lire la documentation : https://elevenlabs.io/docs/capabilities/speech-to-text

Inscrivez-vous ici : https://elevenlabs.io/speech-to-text

Articles similaires

Créez avec l'audio IA de la plus haute qualité