Pourquoi les nombres, les dates, les symboles et les acronymes ne sont-ils pas correctement prononcés ou énoncés dans la bonne langue ?

Les nombres, les dates, les symboles et les acronymes peuvent représenter un défi pour l’IA, car il existe souvent plusieurs façons de les énoncer correctement. Cela peut également dépendre de la langue utilisée. Par exemple, « 11 » peut se lire « Eleven », mais aussi « Once » en espagnol ou « Elf » en allemand.

Vous pouvez appliquer plusieurs méthodes pour garantir l’énonciation correcte des nombres, des dates, des acronymes et des symboles.

Écrivez-les en toutes lettres

Pour de meilleurs résultats, nous vous recommandons d’écrire entièrement en lettres les nombres, les acronymes, les dates et les symboles, de la façon dont vous souhaitez que l’IA les énonce. L’IA dispose ainsi d’un maximum de contexte pour produire le résultat correct. Par exemple, pour « $100 », nous vous recommandons d’écrire « a hundred dollars » ou « one hundred dollars » afin d’obtenir le résultat souhaité.

Utiliser un LLM

Si vous utilisez un grand modèle de langage pour générer vos prompts textuels, par exemple avec ElevenAgents, vous pouvez demander au modèle de toujours écrire en toutes lettres les nombres, les dates, les symboles et les acronymes, selon la façon dont vous souhaitez que l’IA les énonce.

Normalisation

Si vous générez du contenu via l’API, vous pouvez indiquer si la normalisation de texte doit être appliquée à l’aide du paramètre apply_text_normalization. La normalisation de texte écrit les nombres et les dates en toutes lettres afin d’améliorer leur prononciation. Cette option augmente la latence, car le processus de normalisation nécessite un temps de traitement supplémentaire.

Le paramètre apply_text_normalization propose trois modes :

  • on, ce qui signifie qu’il est toujours appliqué
  • off, ce qui signifie qu’il n’est jamais appliqué
  • auto, ce qui signifie que l’IA décide automatiquement quand appliquer la normalisation de texte

Vous pouvez également indiquer la langue de votre prompt à l’aide du paramètre language_code. Il s’agit d’un paramètre facultatif qui accepte les codes de langue ISO 639-1.

Cette option peut être utile pour les prompts courts ou ambigus, par exemple lorsque le texte ne contient que des nombres ou des symboles. Indiquer la langue garantit que le normalisateur applique les règles correctes pour cette langue.

Pour en savoir plus, consultez notre Guide de l’API.

La normalisation est activée par défaut lorsque vous générez du contenu avec Text to Speech sur le site web.

Dans Studio, la normalisation est appliquée automatiquement par défaut, ce qui signifie que l’IA décide quand appliquer la normalisation de texte. Vous pouvez également choisir de toujours l’appliquer. Cette option se trouve dans les paramètres du projet, sous l’onglet Avancé.