Comment choisir le bon modèle

Ce guide vous explique comment choisir le modèle ElevenLabs adapté à votre cas d’usage.

ElevenLabs propose une gamme de modèles optimisés pour différentes exigences. Le bon choix dépend de votre cas d’usage, de vos exigences de latence et de vos attentes en matière de qualité. Consultez le guide des modèles pour connaître toutes les spécifications.

Par exigence

Qualité

Utilisez eleven_v4

Le modèle phare, offrant la plus haute fidélité, l’expression émotionnelle la plus riche et la prise en charge linguistique la plus étendue.

Faible latence

Utilisez eleven_v4_turbo

Optimisé pour les applications en temps réel avec une latence d’environ 100 ms.

Par cas d’usage

Création de contenu

Utilisez eleven_v4

Idéal pour le contenu professionnel, les livres audio et les narrations vidéo.

Agents conversationnels

Utilisez eleven_v4_turbo pour une restitution plus expressive, ou eleven_flash_v2_5 et eleven_flash_v2 pour la latence la plus faible.

Utilisez le modèle 2.5 pour la prise en charge de langues autres que l’anglais.

Optimisé pour les applications conversationnelles en temps réel.

Transcription

Utilisez scribe_v2 pour la transcription par lots, scribe_v2_medical pour l’audio médical et clinique, ou scribe_v2_realtime pour la transcription en temps réel.

Une précision de pointe dans plus de 90 langues, avec diarisation des locuteurs et horodatages au niveau des mots.

Changeur de voix

Utilisez eleven_multilingual_sts_v2

Spécialisé dans la conversion Speech-to-Speech.

Étapes suivantes