Créer une voix
Créer une voix
Paramètres de chemin
ID de la voix à utiliser. Utilisez le point de terminaison Obtenir les voix pour lister toutes les voix disponibles.
En-têtes
Paramètres de requête
Lorsque enable_logging est défini sur false, le mode zéro rétention est utilisé pour la requête. Les fonctionnalités d’historique, y compris l’enchaînement des requêtes, ne sont alors pas disponibles pour cette requête. Le mode zéro rétention est réservé aux clients Enterprise.
Requête
Identifiant du modèle à utiliser. Vous pouvez consulter les modèles avec GET /v1/models. Le modèle doit prendre en charge la synthèse vocale, ce que vous pouvez vérifier avec la propriété can_do_text_to_speech.
Code de langue (ISO 639-1) utilisé pour imposer une langue au modèle et à la normalisation du texte. Si le modèle ne prend pas en charge le code de langue fourni, celui-ci sera ignoré. Ce paramètre n’est pas pris en charge par les modèles multilingual_v2.
Paramètres vocaux remplaçant les paramètres enregistrés pour la voix donnée. Ils s’appliquent uniquement à la requête concernée.
Liste des localisateurs de dictionnaires de prononciation (id, version_id) à appliquer au texte. Ils seront appliqués dans l’ordre. Vous pouvez inclure jusqu’à 3 localisateurs par requête.
Si spécifié, notre système fera de son mieux pour échantillonner de manière déterministe, afin que des requêtes répétées avec la même graine et les mêmes paramètres renvoient le même résultat. Le déterminisme n’est pas garanti. Doit être un entier compris entre 0 et 4294967295.
Le texte qui précède celui de la requête actuelle. Peut être utilisé pour améliorer la continuité de la parole lors de la concaténation de plusieurs générations ou pour influencer la continuité de la parole dans la génération actuelle.
Le texte qui suit celui de la requête actuelle. Peut être utilisé pour améliorer la continuité de la parole lors de la concaténation de plusieurs générations ou pour influencer la continuité de la parole dans la génération actuelle.
Liste des request_id des échantillons générés avant cette génération. Peut être utilisée pour améliorer la continuité de la parole lorsqu’une tâche importante est divisée en plusieurs requêtes. Les résultats seront meilleurs si le même modèle est utilisé pour toutes les générations. Si previous_text et previous_request_ids sont tous deux envoyés, previous_text sera ignoré. Vous pouvez envoyer au maximum 3 request_ids.
Liste des request_id des échantillons suivant cette génération. next_request_ids est particulièrement utile pour préserver la continuité de la parole lors de la régénération d’un échantillon présentant des problèmes de qualité audio. Par exemple, si vous avez généré 3 extraits vocaux et souhaitez améliorer l’extrait 2, transmettre l’identifiant de requête de l’extrait 3 comme next_request_id, ainsi que celui de l’extrait 1 comme previous_request_id, aidera à préserver un flux naturel dans la parole combinée. Les résultats seront meilleurs si le même modèle est utilisé pour toutes les générations. Si next_text et next_request_ids sont tous deux envoyés, next_text sera ignoré. Vous pouvez envoyer au maximum 3 request_ids.
Indique s’il faut utiliser la version IVC d’une voix professionnelle. Cela peut améliorer l’expressivité et réduire la latence.
Ce paramètre contrôle la normalisation du texte selon trois modes : « auto », « on » et « off ». Lorsqu’il est défini sur « auto », le système décide automatiquement d’appliquer ou non la normalisation du texte, par exemple en écrivant les nombres en toutes lettres. Avec « on », la normalisation est toujours appliquée, tandis qu’avec « off », elle est ignorée.
Ce paramètre contrôle la normalisation linguistique du texte. Il améliore la prononciation du texte dans certaines langues prises en charge. AVERTISSEMENT : ce paramètre peut considérablement augmenter la latence de la requête. Actuellement pris en charge uniquement pour le japonais.
Réponse
Le fichier audio généré