For the complete documentation index, see llms.txt. This page is also available as Markdown.

Clonage d'une voix pour le Changeur de voix

Clonez votre propre voix en tant que voix de Changeur de voix dans ACE Studio.

Qu’est-ce que le clonage du Changeur de voix ?

Il s’agit d’une fonctionnalité qui vous permet de personnaliser votre propre voix de Changeur de voix en téléversant vos Échantillons. L’IA apprendra le Timbre à partir des Échantillons que vous téléversez et clonera une version numérique de cette voix.

Après la personnalisation, vous pouvez utiliser votre profil pour convertir des Voix à partir de l’Audio, tout comme nos voix de Changeur de voix IA préconfigurées dans ACE Studio.

Comment cloner ma voix pour le Changeur de voix ?

Préparer vos jeux de données

Voix sèches propres

Des Voix de haute qualité nécessitent des échantillons vocaux propres et secs :

  • Sans aucun effet de réverbération, de délai ou de chorus

  • Sans bruit de fond

  • Sans instrumentaux ni sons non humains

  • Sans harmonies ni Doubles vocaux

30 à 100 min d’Échantillons vocaux chantés sont recommandées pour une Voix. Plus vous fournissez d’Échantillons, plus l’IA peut apprendre de détails de chant, mais les bénéfices deviennent moindres au-delà de 120 minutes.

Réflexions de la pièce

Des Voix enregistrées avec de fortes réflexions de pièce peuvent provoquer des erreurs de reconnaissance et entraîner des performances de Modèle inattendues.

Voix issues du Séparateur de stems

Lorsque vous utilisez un suppresseur de voix ou un Séparateur de stems pour les Voix, la qualité de sortie peut être trop dégradée pour l’entraînement. Pour un Modèle de voix de meilleure qualité, utilisez de préférence des Voix issues du Séparateur de stems.

Enregistrement des Échantillons

Microphone de qualité avec interface Audio

Les microphones professionnels avec interface Audio apportent des Voix de haute qualité. Vous aurez besoin d’un logiciel d’enregistrement pour connecter votre interface, enregistrer, éditer et mixer vos Voix.

Lors de l’enregistrement d’un Modèle de voix, évitez les microphones qui ne sont pas conçus pour le chant :

  • Micros de téléphone ou d’ordinateur portable

  • Micros cravate ou casque

  • Micros de karaoké

  • Micros d’écouteurs ou écouteurs Bluetooth comme les AirPods (généralement destinés aux appels téléphoniques)

Environnement d’enregistrement

  1. Les bruits de fond indésirables peuvent inclure des personnes qui parlent, des bourdonnements et grésillements électriques, le trafic et les bruits extérieurs, ainsi que les mouvements d’accessoires ou d’objets. Pour éviter que ces bruits n’interfèrent avec votre enregistrement, il est important de choisir un endroit calme. Choisissez un lieu où vous pouvez réduire au minimum, voire éliminer, les perturbations sonores inattendues.

  2. Des réflexions sonores peuvent se produire en raison de la présence de surfaces dures et planes, entraînant de la réverbération ou des échos dans vos enregistrements. Cela peut donner à vos Pistes une qualité creuse ou lointaine, au détriment de l’intimité et de la clarté recherchées.

  3. Essayez d’applaudir sèchement dans la pièce et écoutez attentivement. Si vous percevez un son flottant ou un écho prolongé, cela indique la présence de problèmes de réverbération.

  4. Pour y remédier, intégrez des matériaux doux capables d’absorber le son. Pensez à utiliser des tapis, des carpettes ou des rideaux épais pour réduire considérablement les réflexions. Recouvrir les sols durs et, si possible, suspendre des rideaux aux fenêtres, ainsi que placer dans la pièce des meubles recouverts de tissu, peut être bénéfique.

  5. Évitez d’utiliser des surfaces dures, car elles contribuent au problème. Si vous ne pouvez pas vous offrir des panneaux acoustiques professionnels, vous pouvez utiliser des objets du quotidien comme des peintures sur Canevas, des tapisseries ou des dalles de mousse pour casser ces surfaces.

  6. Lorsque vous installez votre microphone, soyez attentif à son placement. Évitez de le positionner trop près des murs ou dans les coins. Visez plutôt le centre de la pièce ou testez différents emplacements pour trouver l’endroit optimal avec un minimum de réverbération.

Fuite du casque

Pendant les enregistrements, en particulier lors de la capture de Voix, il est courant que le son du casque s’infiltre dans le microphone. Ce problème survient lorsque le volume du casque est réglé trop fort ou lorsqu’on utilise des casques ouverts. Cela peut être acceptable lors de l’enregistrement d’une chanson, mais essayez d’éviter cette fuite lorsque vous enregistrez votre Modèle de voix.

Placement du microphone

Pour un volume normal, il est recommandé de vous placer à environ 2 pouces du microphone. En revanche, pour des phrases plus puissantes ou lorsque vous chantez en voix pleine, il est conseillé d’augmenter la distance à environ 4 à 6 pouces. Il est important de noter que vous devez toujours rester à moins de 12 pouces du microphone afin de maintenir une capture Audio optimale.

Créer de l’espace pour le belting

Lorsque vous utilisez des techniques de belting, il est important de vous laisser suffisamment d’espace, à la fois en termes de distance avec le microphone et de taille de la pièce dans laquelle vous vous trouvez. Une isolation sonore excessive, comme le fait d’être confiné dans un placard ou une cabine, ou de entourer votre microphone de mousse, peut facilement entraîner une surcharge de la capsule du microphone. Si vous avez un doute, il est conseillé d’intégrer davantage le son de la pièce lorsque vous interprétez des phrases en belting.

Langues de chant

Pour une voix de Changeur de voix, vous n’avez pas besoin de conserver tous les Échantillons dans une seule langue.

Chant ou parole

Pour une voix de Changeur de voix, il n’y a pas de grande différence entre des Échantillons de parole et des Échantillons de chant. Mais pour une voix de Changeur de voix chantée, il est plus adapté d’utiliser des Échantillons de chant pour l’entraînement.

Paramètres de qualité des fichiers

La qualité Audio de vos Échantillons influence directement la qualité de votre Voix.

Nous vous recommandons de régler votre qualité Audio sur :

  • Profondeur de bits = 16 bits

  • Taux d'échantillonnage = 44,1 kHz ou 48 kHz

  • Format de fichier sans perte (.wav ou .flac)

Post-traitement

Pour préserver le caractère naturel et la clarté de votre Voix cible :

  • Pas de chevauchements : les Voix multicouches peuvent compliquer l’analyse de l’IA. Placez les prises superposées en arrière-plan et limitez-vous à une seule Piste vocale afin de garantir que l’IA puisse traiter et apprendre correctement à partir de vos Échantillons.

  • Pas de coupes franches : les coupes franches peuvent créer des débuts ou des fins brusques, ce qui n’est pas naturel dans un chant et peut introduire des clics ou des pops. Utilisez des fondus progressifs au début et à la fin du Clip vocal pour une transition plus naturelle.

  • Pas de sections dupliquées : Les sections dupliquées n’aident pas l’entraînement. Votre Modèle de voix bénéficie de la variation naturelle de l’interprétation.

  • Contrôlez le volume : Assurez-vous que vos Échantillons restent autour de 30 à 50 % de votre vumètre. Utilisez un volume rider ou l’Automatisation pour vous assurer que les niveaux de volume restent cohérents sur l’ensemble de votre jeu de données. L’objectif est de créer un niveau de volume uniforme sur l’ensemble de l’enregistrement tout en conservant la dynamique à l’intérieur des sections.

Entraîner votre Voix

Après avoir préparé vos jeux de données, vous pouvez aller sur Page de Voix personnalisée pour sélectionner un emplacement personnalisé, téléverser vos Échantillons et lancer l’entraînement.

Vous pouvez personnaliser une voix de Changeur de voix dans un seul emplacement personnalisé.

Cliquez sur un emplacement pour commencer à téléverser vos Échantillons.

Une fois tous les Échantillons téléversés, l’entraînement démarre automatiquement. Vous pouvez vérifier son état en actualisant la page web.

Lorsque la page revient à la liste des emplacements avec une nouvelle voix entraînée, tout est prêt.

Cliquez sur « Ouvrir dans ACE » pour ouvrir ACE Studio et utiliser votre nouvelle voix entraînée.

Réentraîner votre Voix

Cliquez sur le Réentraîner bouton pour réentraîner votre voix.

Le réentraînement supprimera votre voix précédente dans cet emplacement. L’IA commencera à entraîner une toute nouvelle voix à partir de zéro en utilisant le nouveau jeu de données. Avant de lancer le processus de réentraînement, vous avez la possibilité de conserver les Échantillons historiques dans cet emplacement et d’ajouter de nouveaux Échantillons, ou bien de supprimer les Échantillons historiques et d’utiliser uniquement les nouveaux Échantillons téléversés.

Lors de la préparation de nouveaux Échantillons, veuillez noter :

  • Si la Durée des Échantillons nouvellement ajoutés est nettement inférieure à celle des Échantillons déjà téléversés, par exemple en ajoutant 1 min de nouvel Échantillon à un jeu de données de 30 min, le réentraînement peut ne pas apporter de changements significatifs aux performances.

  • Le réentraînement ne changera pas le type de votre emplacement.

Quand dois-je réentraîner ma voix ?

  • Lorsque vos jeux de données ont une meilleure qualité ou une quantité plus importante qu’auparavant, vous pouvez les utiliser pour améliorer votre Voix de manière itérative

  • Lorsque vous n’êtes pas satisfait du résultat actuel et souhaitez ajuster vos jeux de données

Gérer votre Voix

Cliquez sur le Gérer bouton pour ouvrir la fenêtre de gestion d’une voix personnalisée de Changeur de voix. Dans cette fenêtre, vous pouvez modifier :

  • Image de la Voix

  • Nom de la Voix

  • Tags

  • Type de Voix

  • Balise de langue (uniquement pour le type de Voix)

Après avoir effectué les modifications, vous pouvez cliquer sur le Ouvrir dans ACE bouton pour actualiser la liste des Voix d’ACE Studio.

Mis à jour