Clonage de voix
Découvrez comment cloner votre voix avec nos modèles de pointe.
Présentation
Pour cloner une voix, deux options principales sont disponibles : le clonage de voix instantané et le clonage de voix professionnel. Le clonage de voix instantané permet de cloner votre voix rapidement et facilement, tandis que le clonage de voix professionnel offre une option plus précise et personnalisable.
Clonage de voix instantané

Le clonage de voix instantané vous permet de créer des clonages de voix à partir d’échantillons courts, presque instantanément. La création d’un clonage de voix instantané (IVC) n’entraîne pas et ne crée pas de modèle IA personnalisé. Elle s’appuie plutôt sur les connaissances acquises à partir des données d’entraînement pour faire une estimation éclairée, au lieu de s’entraîner sur la voix exacte.
Cette méthode fonctionne extrêmement bien pour de nombreuses voix. Toutefois, la principale limite des IVC survient lorsque vous essayez de cloner une voix très particulière, ou une voix avec un accent auquel l’IA n’a peut-être pas été largement exposée pendant l’entraînement. Dans ce cas, le clonage de voix professionnel peut être la meilleure option pour créer un modèle personnalisé grâce à un entraînement explicite.
Clonage de voix professionnel

Le clonage de voix professionnel est une fonctionnalité disponible avec notre forfait Creator ou supérieur. Il vous permet d’entraîner un modèle plus réaliste de votre voix à partir d’un ensemble plus vaste de données vocales, afin d’obtenir un modèle pratiquement indiscernable de la voix originale.
Comme les modèles personnalisés nécessitent un réglage fin et un entraînement, les PVC demandent plus de temps que les IVC. En règle générale, le réglage fin prend entre 3 et 6 heures, mais peut parfois être un peu plus long selon le nombre d’autres PVC en attente de réglage fin.
Guide du débutant pour l’enregistrement audio
Si vous débutez dans l’enregistrement audio, voici quelques conseils pour bien commencer.
Lieu d’enregistrement
Lorsque vous enregistrez de l’audio, choisissez un lieu adapté et aménagez-le de manière à réduire au minimum l’écho et la réverbération de la pièce. L’objectif est d’atténuer autant que possible la réverbération de la pièce. C’est précisément le rôle d’une cabine vocale traitée acoustiquement. Si vous n’en avez pas à disposition, vous pouvez expérimenter avec une cabine vocale DIY, une « cabane de couvertures » ou un placard.
Voici quelques exemples YouTube d’idées d’acoustique DIY :
- J’ai fabriqué une cabine vocale pour 0,00 $ !
- Comment enregistrer de BONNES voix dans une MAUVAISE pièce
- Les 5 MEILLEURS CONSEILS pour enregistrer des voix à la maison !
Microphone, filtre anti-pop et interface audio
Un bon microphone est essentiel. Le prix des microphones peut aller de $100 à $10,000, mais un microphone XLR professionnel coûtant entre $150 et $300 suffit pour la plupart des travaux de voix off.
Pour une configuration abordable et de qualité pour les travaux de voix off, envisagez une interface Focusrite associée à un microphone Audio-Technica AT2020 ou Rode NT1 microphone. Cette configuration, qui coûte entre $300 et $500, offre un enregistrement de haute qualité adapté à un usage professionnel, avec un faible bruit propre pour des résultats nets.
Veillez à placer un filtre anti-pop adapté devant le microphone lors de l’enregistrement afin d’éviter les plosives, ainsi que la respiration et l’air frappant directement la membrane ou le microphone. Cela dégraderait le son et compliquerait le processus de clonage.
Station de travail audionumérique (DAW)
Il existe de nombreuses solutions d’enregistrement qui remplissent toutes la même fonction : enregistrer de l’audio. Elles ne se valent toutefois pas toutes. Tant qu’elles peuvent enregistrer des fichiers WAV à 44,1 kHz ou 48 kHz avec une profondeur de bits d’au moins 24 bits, elles devraient convenir. Vous n’avez besoin d’aucun post-traitement complexe, plugin, débruiteur ou autre, car l’objectif est de garder l’enregistrement audio simple.
Si vous souhaitez une recommandation, nous vous suggérons REAPER, un excellent DAW extrêmement flexible. C’est la référence du secteur pour de nombreux travaux audio. Audacity est une autre bonne option gratuite.
Maintenez des niveaux d’enregistrement optimaux, ni trop élevés ni trop faibles, pour éviter la distorsion numérique et le bruit excessif. Pour les travaux de voix off, visez des pics entre -6 dB et -3 dB, et un volume moyen de -18 dB, afin de garantir la clarté tout en réduisant le bruit de fond. Surveillez attentivement les niveaux et ajustez-les selon les besoins pour obtenir les meilleurs résultats en fonction du projet et de l’environnement d’enregistrement.
Positionnement
Une règle utile consiste à garder une distance d’environ deux poings du microphone, soit environ 20 cm (7 à 8 po), avec un filtre anti-pop placé entre vous et le microphone. Certaines personnes préfèrent placer le filtre anti-pop tout près d’elles afin de pouvoir s’y appuyer. Cela les aide à maintenir plus facilement une distance constante avec le microphone.
Une autre technique courante pour éviter de respirer directement dans le microphone ou de produire des sons plosifs consiste à parler de biais. Parler de biais réduit le risque que l’air expiré frappe directement le microphone et le fait plutôt passer à côté.
Interprétation
Votre interprétation est l’un des aspects les plus importants de toute cette session d’enregistrement. L’IA tentera de cloner tous les aspects de votre voix avec une grande fidélité. Elle cherchera donc à reproduire votre cadence, votre tonalité, votre style d’interprétation, la durée de vos pauses, vos bégaiements éventuels, vos respirations profondes, votre souffle ou l’usage fréquent de « euh » et de « ah », et peut même les reproduire. Le fichier audio doit donc contenir exactement l’interprétation et la voix que vous souhaitez cloner, ni plus ni moins. C’est aussi pourquoi il est important de trouver un script à lire qui corresponde à la tonalité recherchée.
Lors d’un enregistrement pour l’IA, il est très important de rester cohérent. Si vous enregistrez une voix, gardez-la très expressive tout au long de l’enregistrement ou, au contraire, très posée : ne mélangez pas les deux, car l’IA peut devenir instable si elle ne sait pas quelle partie de la voix cloner. Il en va de même pour un accent : conservez le même accent pendant tout l’enregistrement. La cohérence est essentielle pour un clonage réussi.






