Clonage vocal (Voice Cloning)
Pour créer une voix personnalisée de haute qualité, l'audio d'entrée (données d'entraînement) doit être d'une grande pureté.
- Lieu d'enregistrement (Recording Location) :
- Réduisez l'écho ou la réverbération de la pièce. Isolez le son en utilisant une cabine d'enregistrement, un placard ou en construisant un abri avec des couvertures.
- Équipement :
- Microphone : Il est recommandé d'utiliser un microphone XLR professionnel (dans une fourchette de 150 à 300 dollars, comme l'Audio-Technica AT2020 ou le Rode NT1).
- Interface audio : utilisez une interface USB (telle que Focusrite).
- Filtre anti-pop : indispensable pour éviter les sons explosifs (impact de l'air sur le microphone).
- Logiciels (Software/DAW) :
- Utilisez des logiciels tels que REAPER ou Audacity.
- Paramètres : Enregistrez les fichiers WAV avec une fréquence d'échantillonnage de 44,1 kHz ou 48 kHz et une profondeur de 24 bits.
- Niveaux : visez des crêtes (peaks) comprises entre -6 dB et -3 dB, et un niveau sonore moyen de -18 dB.
- Positionnement :
- Maintenez une distance d'environ 20 cm (l'équivalent de deux poings) par rapport au microphone.
- Parlez en adoptant un angle incliné pour éviter de souffler directement dans le microphone.
- Performance :
- Cohérence : Maintenez la même énergie et la même tonalité tout au long de l'enregistrement. Ne mélangez pas chuchotements et cris dans le fichier d'entraînement.
L'intelligence artificielle reproduit tout, y compris les respirations, les bégaiements et les hésitations (comme « euh... »). Assurez-vous que la prestation correspond exactement à ce que vous souhaitez reproduire.
Passez à l'article suivant du guide Makna.
خ