Clonage d'une voix pour le Changeur de voix
Clonez votre propre voix en tant que voix pour le Changeur de voix dans ACE Studio.
Qu’est-ce que le clonage du Changeur de voix ?
Il s’agit d’une fonctionnalité permettant de personnaliser votre propre voix du Changeur de voix en téléversant vos Échantillons. L’IA apprendra le Timbre à partir des Échantillons que vous téléversez et clonera une version numérique de cette Voix.
Après la personnalisation, vous pouvez utiliser votre profil pour convertir des Voix depuis l’Audio, tout comme nos voix de Changeur de voix IA préconfigurées dans ACE Studio.
Votre Voix IA clonée est privée dans votre compte ; personne d’autre ne peut y accéder sans votre autorisation.
Comment cloner ma Voix pour le Changeur de voix ?
Préparation de vos jeux de données
Voix sèches propres
Des Échantillons vocaux propres et secs de haute qualité sont nécessaires pour une Voix :
Sans aucun effet de réverbération, de délai ou de chorus
Sans bruit de fond
Sans instrumentales ni sons non humains
Sans harmonies ni Doubles vocaux
Il est recommandé de fournir entre 30 et 100 min d’Échantillons vocaux chantés pour une Voix. Plus vous fournissez d’Échantillons, plus l’IA peut apprendre de détails de chant, mais les gains deviennent moindres au-delà de 120 minutes.
Réflexions de pièce
Des Voix enregistrées avec de fortes réflexions de pièce peuvent provoquer des erreurs de reconnaissance et entraîner un comportement inattendu du Modèle.
Voix provenant du Séparateur de stems
Lorsque vous utilisez un suppresseur de voix ou un Séparateur de stems pour les Voix, la qualité de sortie peut être trop dégradée pour l’entraînement. Pour obtenir un Modèle de Voix de meilleure qualité, utilisez si possible des Voix issues du Séparateur de stems.
Enregistrement des Échantillons
Microphone de qualité avec interface Audio
Les microphones professionnels avec interface Audio offrent des Voix de haute qualité. Vous aurez besoin d’un logiciel d’enregistrement pour connecter votre interface, enregistrer, éditer et mixer vos Voix.
Lors de l’enregistrement pour un Modèle de Voix, évitez les microphones qui ne sont pas conçus pour le chant :
Micros de téléphone ou d’ordinateur portable
Micros cravate ou de casque
Micros de karaoké
Micros d’écouteurs ou écouteurs Bluetooth comme les AirPods (ils sont généralement destinés aux appels téléphoniques)
Environnement d’enregistrement
Les bruits de fond indésirables peuvent inclure des personnes qui parlent, des bourdonnements et des grésillements électriques, le trafic et les bruits extérieurs, ainsi que les mouvements d’accessoires ou d’objets. Pour éviter que ces bruits n’interfèrent avec votre enregistrement, il est important de choisir un endroit calme. Choisissez un lieu où vous pouvez réduire au minimum, voire éliminer, les perturbations sonores inattendues.
Des réflexions sonores peuvent se produire en présence de surfaces dures et planes, entraînant de la réverbération ou des échos dans vos enregistrements. Cela peut donner à vos Pistes une qualité creuse ou lointaine, au détriment de l’intimité et de la clarté recherchées.
Essayez d’applaudir sèchement dans la pièce et écoutez attentivement. Si vous percevez un son de flottement ou un écho prolongé, cela indique la présence de problèmes de réverbération.
Pour y remédier, intégrez des matériaux Doux capables d’absorber le son. Pensez à utiliser des tapis, des moquettes ou de lourds rideaux pour réduire considérablement les réflexions. Recouvrir les sols durs et, si possible, suspendre des rideaux devant les fenêtres, ainsi qu’installer dans la pièce des meubles recouverts de tissu, peut être bénéfique.
Évitez d’utiliser des surfaces dures, car elles aggravent le problème. Si vous ne pouvez pas vous offrir des panneaux acoustiques professionnels, vous pouvez utiliser des objets du quotidien comme des toiles peintes, des tentures ou des dalles de mousse pour casser ces surfaces.
Lors de l’installation de votre microphone, soyez attentif à son emplacement. Évitez de le placer trop près des murs ou dans les coins. Visez plutôt le centre de la pièce ou testez différents emplacements pour trouver la zone optimale avec un minimum de réverbération.
Repisse du casque
Pendant les enregistrements, notamment lors de la prise de Voix, il est courant que l’Audio du casque repisse dans le microphone. Ce problème survient lorsque le volume du casque est trop élevé ou lorsque des casques ouverts sont utilisés. Cela peut être acceptable lors d’un enregistrement pour une chanson, mais essayez d’éviter cette repisse lors d’un enregistrement pour votre Modèle de Voix.
Placement du microphone
Pour un volume normal, il est recommandé de vous placer à environ 5 cm du microphone. En revanche, pour des phrases plus fortes ou en belting, il est conseillé d’augmenter la distance à environ 10 à 15 cm. Il est important de noter que vous devez toujours rester à moins de 30 cm du microphone afin de maintenir une capture Audio optimale.
Créer de l’espace pour le belting
Lorsque vous utilisez des techniques de belting, il est important de vous laisser suffisamment d’espace, tant au niveau de la distance avec le microphone que de la taille de la pièce. Une isolation sonore excessive, par exemple être confiné dans un placard ou une cabine, ou entourer votre microphone de mousse, peut facilement saturer la capsule du microphone. En cas de doute, il est conseillé d’intégrer davantage de son de pièce lors de l’interprétation de phrases en belting.
Langues de chant
Pour une voix du Changeur de voix, vous n’avez pas besoin de conserver tous les Échantillons dans une seule langue.
Chant ou parole
Pour une voix du Changeur de voix, il n’y a pas de grande différence entre les Échantillons de parole et les Échantillons de chant. En revanche, pour une voix du Changeur de voix chantée, il est plus approprié d’utiliser des Échantillons de chant pour l’entraînement.
Paramètres de qualité des fichiers
La qualité Audio de vos Échantillons influe directement sur la qualité de votre Voix.
Nous vous recommandons de régler votre qualité Audio sur :
Profondeur de bits = 16 bits
Taux d'échantillonnage = 44,1 kHz ou 48 kHz
Format de fichier sans perte (.wav ou .flac)
Post-traitement
Pour préserver le caractère naturel et la clarté de votre Voix cible :
Pas de chevauchements : Les Voix multicouches peuvent compliquer l’analyse de l’IA. Placez les prises superposées en arrière-plan et limitez-vous à une seule Piste vocale afin de garantir que l’IA puisse traiter et apprendre vos Échantillons avec précision.
Pas de coupures nettes : Les coupures nettes peuvent créer des débuts ou des fins abrupts, inhabituels dans un chant naturel, et provoquer des clics ou des pops. Utilisez des fondus enchaînés doux au début et à la Fin du Clip vocal pour une transition plus naturelle.
Pas de sections dupliquées : Les sections dupliquées n’aident pas à l’entraînement. Votre Modèle vocal bénéficie de la variation naturelle de l’interprétation.
Contrôlez le volume : Assurez-vous que vos Échantillons restent autour de 30 à 50 % de votre vu-mètre. Utilisez un ajusteur de volume ou l’Automatisation pour garantir une cohérence des niveaux de volume sur l’ensemble de votre jeu de données. L’objectif est de créer un niveau de volume homogène sur l’enregistrement tout en conservant la dynamique à l’intérieur des sections.
Entraîner votre Voix
Après avoir préparé vos jeux de données, vous pouvez aller sur Page de voix personnalisée pour sélectionner un emplacement personnalisé, téléverser vos Échantillons et lancer l’entraînement.
Vous pouvez personnaliser une voix du Changeur de voix dans un seul emplacement personnalisé.
Cliquez sur un emplacement pour commencer à téléverser vos Échantillons.
Une fois tous les Échantillons téléversés, l’entraînement démarrera automatiquement. Vous pouvez vérifier son état en actualisant la page Web.
Lorsque la page revient à la liste des emplacements avec une nouvelle Voix entraînée, tout est prêt.
Cliquez sur « Open in ACE » pour ouvrir ACE Studio et utiliser votre nouvelle Voix entraînée.
Réentraînement de votre Voix
Cliquez sur le Réentraîner bouton pour réentraîner votre Voix.
Le réentraînement supprimera votre Voix précédente dans cet emplacement. L’IA commencera à entraîner une nouvelle Voix complètement à partir de zéro en utilisant le nouveau jeu de données. Avant de lancer le processus de réentraînement, vous avez la possibilité soit de conserver les Échantillons historiques dans cet emplacement et d’ajouter de nouveaux Échantillons, soit d’effacer les Échantillons historiques et d’utiliser uniquement les Échantillons nouvellement téléversés.
Lors de la préparation de nouveaux Échantillons, veuillez noter :
Si la Durée des Échantillons nouvellement ajoutés est nettement inférieure à celle des Échantillons déjà téléversés, par exemple ajouter 1 min de nouvel Échantillon à un jeu de données de 30 min, le réentraînement peut ne pas apporter de changements significatifs aux performances.
Le réentraînement ne modifiera pas le type de votre emplacement.
Quand dois-je réentraîner ma Voix ?
Lorsque vos jeux de données sont de meilleure qualité ou plus volumineux qu’auparavant, vous pouvez les utiliser pour améliorer progressivement votre Voix
Lorsque vous n’êtes pas satisfait du résultat actuel et souhaitez ajuster vos jeux de données
Gestion de votre Voix
Cliquez sur le Gérer bouton pour ouvrir la fenêtre de gestion d’une voix personnalisée du Changeur de voix. Dans cette fenêtre, vous pouvez modifier :
Image de la Voix
Nom de la Voix
Tags
Type de Voix
Balise de langue (uniquement pour le type de Voix)
Après avoir effectué les modifications, vous pouvez cliquer sur le Open in ACE bouton pour actualiser la liste des Voix dans ACE Studio.
Mis à jour