> For the complete documentation index, see [llms.txt](https://docs.acestudio.ai/llms.txt). Markdown versions of documentation pages are available by appending `.md` to page URLs; this page is available as [Markdown](https://docs.acestudio.ai/docs/product-wiki-fr/clonage-vocal/cloning-a-voice-for-vocal-synth.md).

# Clonage d'une Voix pour Synthèse Vocale

Clonez votre propre voix en tant que voix pour Synthèse Vocale dans ACE Studio.

## Qu’est-ce que le Clonage Vocal de Synthèse Vocale ? <a href="#block-17608bffde808018b367cbddf8c9fe36" id="block-17608bffde808018b367cbddf8c9fe36"></a>

Il s’agit d’une fonctionnalité permettant de personnaliser votre propre Modèle de Synthèse Vocale en téléversant vos Échantillons de Voix. L’IA apprendra le Timbre et le style de chant à partir des Échantillons que vous téléversez, et clonera une version numérique de votre Voix.

Après la personnalisation, vous pouvez utiliser votre Voix pour générer des Voix à partir de MIDI et de Paroles, tout comme nos Voix IA préconfigurées dans ACE Studio.

{% hint style="success" %}
Votre voix IA clonée est privée dans votre compte ; personne d’autre ne peut y accéder sans votre autorisation.
{% endhint %}

## Comment cloner ma Voix pour Synthèse Vocale ? <a href="#block-17608bffde8080b98024eb3edc82d4d6" id="block-17608bffde8080b98024eb3edc82d4d6"></a>

### Préparer vos jeux de données

<details>

<summary>Voix sèches propres</summary>

Des Voix de haute qualité nécessitent des échantillons vocaux propres et secs :

* Sans aucun effet de réverbération, de délai ou de chorus
* Sans bruit de fond
* Sans instrumentaux ni sons non humains
* Sans harmonies ni Doubles vocaux

30 à 100 min d’Échantillons vocaux chantés sont recommandées pour une Voix. Plus vous fournissez d’Échantillons, plus l’IA peut apprendre de détails de chant, mais les bénéfices deviennent moindres au-delà de 120 minutes.

> Réflexions de la pièce
>
> Des Voix enregistrées avec de fortes réflexions de pièce peuvent provoquer des erreurs de reconnaissance et entraîner des performances de Modèle inattendues.

> Voix issues du Séparateur de stems
>
> Lorsque vous utilisez un suppresseur de voix ou un Séparateur de stems pour les Voix, la qualité de sortie peut être trop dégradée pour l’entraînement. Pour un Modèle de voix de meilleure qualité, utilisez de préférence des Voix issues du Séparateur de stems.

</details>

<details>

<summary>Enregistrement des Échantillons</summary>

**Microphone de qualité avec interface Audio**

Les microphones professionnels avec interface Audio apportent des Voix de haute qualité. Vous aurez besoin d’un logiciel d’enregistrement pour connecter votre interface, enregistrer, éditer et mixer vos Voix.

Lors de l’enregistrement d’un Modèle de voix, évitez les microphones qui ne sont pas conçus pour le chant :

* Micros de téléphone ou d’ordinateur portable
* Micros cravate ou casque
* Micros de karaoké
* Micros d’écouteurs ou écouteurs Bluetooth comme les AirPods (généralement destinés aux appels téléphoniques)

**Environnement d’enregistrement**

1. Les bruits de fond indésirables peuvent inclure des personnes qui parlent, des bourdonnements et grésillements électriques, le trafic et les bruits extérieurs, ainsi que les mouvements d’accessoires ou d’objets. Pour éviter que ces bruits n’interfèrent avec votre enregistrement, il est important de choisir un endroit calme. Choisissez un lieu où vous pouvez réduire au minimum, voire éliminer, les perturbations sonores inattendues.
2. Des réflexions sonores peuvent se produire en raison de la présence de surfaces dures et planes, entraînant de la réverbération ou des échos dans vos enregistrements. Cela peut donner à vos Pistes une qualité creuse ou lointaine, au détriment de l’intimité et de la clarté recherchées.
3. Essayez d’applaudir sèchement dans la pièce et écoutez attentivement. Si vous percevez un son flottant ou un écho prolongé, cela indique la présence de problèmes de réverbération.
4. Pour y remédier, intégrez des matériaux doux capables d’absorber le son. Pensez à utiliser des tapis, des carpettes ou des rideaux épais pour réduire considérablement les réflexions. Recouvrir les sols durs et, si possible, suspendre des rideaux aux fenêtres, ainsi que placer dans la pièce des meubles recouverts de tissu, peut être bénéfique.
5. Évitez d’utiliser des surfaces dures, car elles contribuent au problème. Si vous ne pouvez pas vous offrir des panneaux acoustiques professionnels, vous pouvez utiliser des objets du quotidien comme des peintures sur Canevas, des tapisseries ou des dalles de mousse pour casser ces surfaces.
6. Lorsque vous installez votre microphone, soyez attentif à son placement. Évitez de le positionner trop près des murs ou dans les coins. Visez plutôt le centre de la pièce ou testez différents emplacements pour trouver l’endroit optimal avec un minimum de réverbération.

**Fuite du casque**

Pendant les enregistrements, en particulier lors de la capture de Voix, il est courant que le son du casque s’infiltre dans le microphone. Ce problème survient lorsque le volume du casque est réglé trop fort ou lorsqu’on utilise des casques ouverts. Cela peut être acceptable lors de l’enregistrement d’une chanson, mais essayez d’éviter cette fuite lorsque vous enregistrez votre Modèle de voix.

**Placement du microphone**

Pour un volume normal, il est recommandé de vous placer à environ 2 pouces du microphone. En revanche, pour des phrases plus puissantes ou lorsque vous chantez en voix pleine, il est conseillé d’augmenter la distance à environ 4 à 6 pouces. Il est important de noter que vous devez toujours rester à moins de 12 pouces du microphone afin de maintenir une capture Audio optimale.

> Créer de l’espace pour le belting
>
> Lorsque vous utilisez des techniques de belting, il est important de vous laisser suffisamment d’espace, à la fois en termes de distance avec le microphone et de taille de la pièce dans laquelle vous vous trouvez. Une isolation sonore excessive, comme le fait d’être confiné dans un placard ou une cabine, ou de entourer votre microphone de mousse, peut facilement entraîner une surcharge de la capsule du microphone. Si vous avez un doute, il est conseillé d’intégrer davantage le son de la pièce lorsque vous interprétez des phrases en belting.

</details>

<details>

<summary>Langues de chant</summary>

**Emplacement personnalisé basique**

Une seule langue de chant sera prise en charge dans votre Modèle de Voix entraîné avec un emplacement personnalisé basique.

**Emplacement personnalisé Pro**

Votre Voix entraînée avec un emplacement personnalisé Pro peut devenir multilingue.

**Langues dans vos Échantillons**

Pendant le processus d’entraînement, chaque fichier d’Échantillons sera traité individuellement et considéré comme un fichier monolingue. Il est important d’éviter de mélanger des phrases de langues différentes dans un même fichier d’Échantillons.

Lors du téléversement des Échantillons, assurez-vous de les placer dans l’onglet de langue approprié. Même si vous téléversez des Échantillons pour un emplacement personnalisé basique, vous avez la flexibilité de téléverser des Échantillons dans différentes langues si nécessaire. Conserver les Échantillons organisés par langue aidera à maintenir la clarté et à améliorer le processus d’entraînement.

**Langues à venir**

Nous travaillons en continu au développement de nouvelles langues de chant pour la fonctionnalité de Voix personnalisée.

Pour votre nouvelle Voix :

* Les nouvelles langues seront prises en charge par les nouveaux emplacements personnalisés Pro.
* Les nouvelles langues feront partie des options prises en charge par les nouveaux emplacements personnalisés basiques.

Pour votre Voix existante :

* Les nouvelles langues seront prises en charge lors du réentraînement de vos emplacements personnalisés Pro.
* Les nouvelles langues seront facultatives lors du réentraînement de vos emplacements personnalisés basiques.

</details>

<details>

<summary>Chant ou parole</summary>

Les Échantillons de chant et les Échantillons de parole peuvent tous deux être acceptés pour entraîner votre Modèle de Voix chantée.

Votre Voix peut apprendre :

* Le Timbre à partir de vos Échantillons de chant et de vos Échantillons de parole, mais veuillez noter : chez une personne, le Timbre de la parole peut être différent de celui du chant, ce qui ne peut généralement pas représenter la véritable performance chantée.
* Le style de chant à partir de vos Échantillons de chant

Votre Voix ne peut pas apprendre :

* Le style de chant à partir de vos Échantillons de parole

</details>

<details>

<summary>Paramètres de qualité des fichiers</summary>

La qualité Audio de vos Échantillons influence directement la qualité de votre Voix.

Nous vous recommandons de régler votre qualité Audio sur :

* Profondeur de bits = 16 bits
* Taux d'échantillonnage = 44,1 kHz ou 48 kHz
* Format de fichier sans perte (.wav ou .flac)

</details>

<details>

<summary>Post-traitement</summary>

Pour préserver le caractère naturel et la clarté de votre Voix cible :

* **Pas de chevauchements :** les Voix multicouches peuvent compliquer l’analyse de l’IA. Placez les prises superposées en arrière-plan et limitez-vous à une seule Piste vocale afin de garantir que l’IA puisse traiter et apprendre correctement à partir de vos Échantillons.
* **Pas de coupes franches :** les coupes franches peuvent créer des débuts ou des fins brusques, ce qui n’est pas naturel dans un chant et peut introduire des clics ou des pops. Utilisez des fondus progressifs au début et à la fin du Clip vocal pour une transition plus naturelle.
* **Pas de sections dupliquées :** Les sections dupliquées n’aident pas l’entraînement. Votre Modèle de voix bénéficie de la variation naturelle de l’interprétation.
* **Contrôlez le volume :** Assurez-vous que vos Échantillons restent autour de 30 à 50 % de votre vumètre. Utilisez un volume rider ou l’Automatisation pour vous assurer que les niveaux de volume restent cohérents sur l’ensemble de votre jeu de données. L’objectif est de créer un niveau de volume uniforme sur l’ensemble de l’enregistrement tout en conservant la dynamique à l’intérieur des sections.

</details>

### Entraîner votre Voix

Après avoir préparé vos jeux de données, vous pouvez aller sur <a href="https://acestudio.ai/app/custom-voice/vocal-synth" class="button secondary" data-icon="browser">Page de Voix personnalisée</a> pour sélectionner un Emplacement personnalisé, téléversez vos Échantillons de Voix et lancez l’entraînement.

Un Emplacement personnalisé Basique vous offre une Voix monolingue avec 5 versions.

Un Emplacement personnalisé Pro vous offre une Voix multilingue avec 5 versions.

Cliquez sur un emplacement pour commencer à téléverser vos Échantillons.

Une fois tous les Échantillons téléversés, l’entraînement démarrera automatiquement. Vous pouvez vérifier l’état en actualisant la page web.

Lorsque la page d’entraînement se transforme en page de gestion du clonage vocal, votre Voix est entièrement configurée. Elle apparaîtra dans votre bibliothèque de Voix dans ACE Studio. Si vous ne la voyez pas, essayez de relancer ACE Studio.

{% hint style="info" %}
**Conseils Pro**

Si vous recherchez une interprétation et un caractère uniques pour une Voix, par exemple les meilleurs résultats sur différentes tessitures ou émotions, il vaut mieux répartir les Échantillons sur plusieurs Voix.

Voici un exemple :

Mike est un chanteur professionnel et souhaite personnaliser sa propre Voix. Il se débrouille aussi bien en ténor qu’en basse. Il serait donc préférable d’entraîner 2 Voix :

* Entraînez une Voix aiguë et puissante à partir d’Échantillons contenant majoritairement des interprétations aiguës et puissantes.
* Entraînez une Voix de Basse à partir d’Échantillons contenant majoritairement des phrases graves.
  {% endhint %}

### Réentraîner votre Voix

Cliquez sur le <kbd>Réentraîner</kbd> bouton pour réentraîner votre voix.

Le réentraînement supprimera votre Voix précédente dans cet emplacement et retirera tout chanteur déployé associé à la Voix. L’IA commencera à entraîner une toute nouvelle Voix à partir de zéro en utilisant le nouveau jeu de données. Avant de lancer le réentraînement, vous pouvez soit conserver les Échantillons historiques dans cet emplacement et téléverser de nouveaux Échantillons supplémentaires, soit choisir d’effacer les Échantillons historiques et n’utiliser que les nouveaux Échantillons téléversés.

Lors de la préparation de nouveaux Échantillons, veuillez noter :

* Si la Durée des Échantillons nouvellement ajoutés est nettement inférieure à celle des Échantillons déjà téléversés, par exemple en ajoutant 1 min de nouvel Échantillon à un jeu de données de 30 min, le réentraînement risque de ne pas apporter de changements significatifs dans les performances de la Voix.
* Le réentraînement ne changera pas le type de votre emplacement.
* Vous pouvez modifier la langue prise en charge de votre Emplacement personnalisé basique par réentraînement.

{% hint style="info" %}
**Quand dois-je réentraîner ma voix ?**

* Lorsque vos jeux de données sont de meilleure qualité ou plus volumineux, vous pouvez les utiliser pour améliorer votre Voix de manière itérative.
* Lorsque vous n’êtes pas satisfait du résultat actuel et souhaitez ajuster vos jeux de données
* Lorsqu’une nouvelle compétence en langue de chant est publiée
  {% endhint %}

### Gérer votre Voix

<details>

<summary>Versions</summary>

L’IA apprend de manière progressive à partir de vos données, en analysant chaque Échantillon dans un processus étape par étape. À mesure que l’apprentissage s’approfondit, le nombre d’étapes augmente. Un entraînement avec un jeu de données de petite taille ou de qualité limitée, par exemple conçu pour la parole plutôt que pour le chant, peut ne nécessiter que quelques étapes. À l’inverse, un jeu de données plus vaste et plus diversifié peut exiger des étapes supplémentaires pour un ajustement complet. Cependant, un nombre excessif d’étapes d’entraînement peut entraîner un surapprentissage, susceptible de dégrader les performances de votre Voix avec des résultats imprévisibles.

À la fin de l’entraînement, vous obtiendrez plusieurs versions basées sur différentes étapes d’entraînement, de Rare à Bien cuit. Vous pouvez trouver la meilleure version en basculant le déploiement et en les comparant entre elles.

</details>

<details>

<summary>Mélanger les voix</summary>

Le mélange des voix produit une Voix hybride. Vous pouvez personnaliser votre Voix pour qu’elle ressemble davantage à votre Voix cible en ajustant les ratios des Voix Mélangées. Pour ce faire, rendez-vous sur la page de gestion des emplacements et cliquez sur le bouton « Mélanger les voix » situé sous chaque version.

Après le mélange, votre Voix adoptera les nouvelles caractéristiques vocales. Pour appliquer ces changements, vous devrez actualiser votre Voix en redémarrant ACE Studio.

</details>

<details>

<summary>Déployer dans ACE Studio</summary>

Pour les emplacements personnalisés basiques et Pro, après avoir déployé une version, vous pouvez basculer le déploiement d’une version à une autre. Vous devez relancer ACE Studio après chaque déploiement pour actualiser votre bibliothèque de Voix.

</details>


---

# Agent Instructions
This documentation is published with GitBook. GitBook is the documentation platform designed so that both humans and AI agents can read, navigate, and reason over technical content effectively. Learn more at gitbook.com.

## Querying This Documentation
If you need additional information that is not directly available in this page, you can query the documentation dynamically by asking a question.

Perform an HTTP GET request on the current page URL with the `ask` query parameter, and the optional `goal` query parameter:

```
GET https://docs.acestudio.ai/docs/product-wiki-fr/clonage-vocal/cloning-a-voice-for-vocal-synth.md?ask=<question>&goal=<endgoal>
```

`ask` is the immediate question: it should be specific, self-contained, and written in natural language.
`goal` is optional and describes the broader end goal you are ultimately trying to accomplish on behalf of the user. GitBook uses it to tailor the answer towards what is most useful for that goal.

The response will contain a direct answer to the question and relevant excerpts and sources from the documentation.

Use this mechanism when the answer is not explicitly present in the current page, you need clarification or additional context, or you want to retrieve related documentation sections.
