Démarrage rapide du clonage de voix professionnel
Démarrage rapide du clonage de voix professionnel
Ce guide vous explique comment créer un clonage de voix professionnel à l’aide de l’API PVC.
Ce guide vous explique comment créer un clonage de voix professionnel (PVC) à l’aide de l’API PVC. Pour créer un PVC via le Dashboard, consultez le guide produit Professional Voice Clone.
La création d’un PVC nécessite de disposer du forfait Creator ou supérieur.
Pour une explication détaillée du fonctionnement interne d’IVC et de PVC, et pour savoir lequel choisir, consultez Clonage de voix : fonctionnement.
Si vous n’êtes pas certain de ce qui est autorisé sur le plan juridique, consultez les Conditions d’utilisation et nos informations sur la sécurité de l’IA pour en savoir plus.
Créer un PVC via l’API comporte beaucoup plus d’étapes que créer un clonage de voix instantané. Les PVC sont plus complexes et nécessitent davantage de données et d’affinage pour produire un clone de qualité.
Utiliser l’API Professional Voice Clone
Ce guide suppose que vous avez configuré votre clé API et votre SDK. Terminez d’abord le démarrage rapide si ce n’est pas déjà fait.
Créer une voix PVC
Créez un fichier nommé example.py ou example.mts, selon le langage de votre choix, puis ajoutez le code suivant pour créer une voix PVC :
Importer des fichiers audio
Importez ensuite les fichiers d’échantillons audio qui serviront à entraîner le PVC. Consultez la section Conseils et suggestions du guide produit PVC pour savoir comment obtenir les meilleurs résultats à partir de vos fichiers audio.
Lancer la séparation des locuteurs
Cette étape tente de séparer les fichiers audio par locuteur. Elle est nécessaire si vous importez de l’audio comportant plusieurs locuteurs.
Récupérer l’audio des locuteurs
L’étape précédente prenant un certain temps, exécutez l’étape suivante dans un processus distinct après son achèvement.
Une fois la séparation des locuteurs terminée, vous disposerez d’une liste de locuteurs pour chaque échantillon. Pour les échantillons comportant plusieurs locuteurs, choisissez celui à utiliser pour le PVC. Vous pouvez récupérer l’audio de chaque locuteur et l’écouter pour l’identifier.
Mettre à jour les échantillons avec les ID de locuteur
Une fois la séparation des locuteurs terminée, vous pouvez mettre à jour les échantillons afin de sélectionner le locuteur à utiliser pour le PVC.
Vérifier le PVC
Avant de pouvoir commencer l’entraînement, une étape de vérification est requise pour garantir que vous êtes autorisé à utiliser la voix. Demandez d’abord le CAPTCHA de vérification.
L’image contient plusieurs lignes de texte que le propriétaire de la voix devra lire à voix haute et enregistrer. Une fois l’enregistrement effectué, envoyez-le afin de vérifier l’identité du propriétaire de la voix.
(Facultatif) Demander une vérification manuelle
Si vous ne parvenez pas à vérifier le CAPTCHA, vous pouvez demander une vérification manuelle. Son traitement prendra plus de temps.
Utilisez cette option uniquement si les étapes de vérification précédentes ont échoué ou ne sont pas possibles, par exemple si le propriétaire de la voix est malvoyant.
Pour connaître la liste des fichiers requis pour une vérification manuelle, contactez l’assistance, car chaque cas peut être différent.
Entraîner le PVC
Lancez ensuite le processus d’entraînement. Sa durée dépend de la longueur et du nombre d’échantillons fournis.
Utiliser la voix nouvellement créée
Une fois le PVC vérifié, vous pouvez l’utiliser comme n’importe quelle autre voix. Consultez le démarrage rapide de Text to Speech pour en savoir plus sur l’utilisation d’une voix.