Qu’est-ce qu’Eleven v4 ?
Qu’est-ce qu’Eleven v4 ?
Nous vous recommandons de passer à Eleven v4 et de le tester avec votre propre contenu.
Eleven v4 est notre modèle Text to Speech le plus récent et le plus avancé, le premier d’une nouvelle génération de modèles. Par rapport à Eleven v3, il améliore la qualité de sortie, la fidélité des voix, les émotions, les balises audio et la couverture linguistique.
La précision du clonage de voix franchit une étape majeure avec Eleven v4. Les voix clonées reproduisent plus fidèlement que tout modèle précédent les caractéristiques de la voix source, notamment le timbre, le rythme et le delivery.
Les clonages de voix instantanés (IVC) sont plus précis que jamais dans Eleven v4. Ils capturent plus fidèlement les caractéristiques distinctives d’une voix source, ce qui facilite la création rapide d’un clone convaincant à partir d’un court échantillon audio.
Les clonages de voix professionnels (PVC) sont entièrement pris en charge dans Eleven v4. Ils s’appuient sur les mêmes avancées en matière de fidélité vocale et offrent une reproduction plus fidèle de la voix source pour les workflows exigeant le plus haut niveau de cohérence et de contrôle.
Eleven v4 existe en deux variantes, afin de vous permettre de choisir le bon équilibre entre qualité et vitesse selon votre cas d’usage :
- Eleven v4 (
eleven_v4), notre modèle de la plus haute qualité, idéal pour la création de contenu, les livres audio, les voix off de personnages et tous les cas d’usage où la qualité est prioritaire. - Eleven v4 Turbo (
eleven_v4_turbo), une qualité extrêmement élevée avec une latence remarquablement faible, conçu pour les cas d’usage en temps réel tels que les agents conversationnels et les expériences vocales interactives.
Les deux variantes utilisent deux paramètres vocaux : la stabilité et la similarité. Les curseurs de style et de vitesse ne sont pas disponibles dans Eleven v4, et le SSML n’est pas pris en charge.
Lorsque la langue que vous générez correspond à celle de votre voix de référence, l’accent d’origine est conservé exactement comme auparavant. Lorsque la langue générée diffère de celle de la voix de référence, Eleven v4 produit une voix fluide et naturelle dans la langue cible, plutôt que de conserver l’accent de la voix de référence dans sa langue d’origine.
Vous pouvez générer du contenu avec Create speech et Stream speech en utilisant l’ID de modèle eleven_v4. Pour plusieurs locuteurs, utilisez Create dialogue et Stream dialogue.
Pour le clonage, les accents, les comparaisons et la description complète, consultez Eleven v4. Pour les balises et le prompting, consultez Prompting Eleven v4.