> For the complete documentation index, see [llms.txt](https://docs.acestudio.ai/llms.txt). Markdown versions of documentation pages are available by appending `.md` to page URLs; this page is available as [Markdown](https://docs.acestudio.ai/docs/product-wiki-fr/clonage-vocal/cloning-a-voice-for-vocal-synth.md).

# Clonage d'une voix pour la Synthèse Vocale

## Qu'est-ce que le clonage vocal de la Synthèse Vocale ? <a href="#block-17608bffde808018b367cbddf8c9fe36" id="block-17608bffde808018b367cbddf8c9fe36"></a>

Il s'agit d'une fonctionnalité qui vous permet de personnaliser votre propre modèle de Synthèse Vocale en téléversant vos échantillons vocaux. L'IA apprendra le timbre et le style de chant à partir des échantillons que vous téléversez, puis clonera une version numérique de votre voix.

Après la personnalisation, vous pouvez utiliser votre voix pour générer des voix à partir du MIDI et des paroles, tout comme nos voix IA préétablies dans ACE Studio.

{% hint style="success" %}
Votre Voix IA clonée est privée dans votre compte ; personne d’autre ne peut y accéder sans votre autorisation.
{% endhint %}

## Comment cloner ma voix pour la Synthèse Vocale ? <a href="#block-17608bffde8080b98024eb3edc82d4d6" id="block-17608bffde8080b98024eb3edc82d4d6"></a>

### Préparation de vos jeux de données

<details>

<summary>Voix sèches propres</summary>

Des Échantillons vocaux propres et secs de haute qualité sont nécessaires pour une Voix :

* Sans aucun effet de réverbération, de délai ou de chorus
* Sans bruit de fond
* Sans instrumentales ni sons non humains
* Sans harmonies ni Doubles vocaux

Il est recommandé de fournir entre 30 et 100 min d’Échantillons vocaux chantés pour une Voix. Plus vous fournissez d’Échantillons, plus l’IA peut apprendre de détails de chant, mais les gains deviennent moindres au-delà de 120 minutes.

> Réflexions de pièce
>
> Des Voix enregistrées avec de fortes réflexions de pièce peuvent provoquer des erreurs de reconnaissance et entraîner un comportement inattendu du Modèle.

> Voix provenant du Séparateur de stems
>
> Lorsque vous utilisez un suppresseur de voix ou un Séparateur de stems pour les Voix, la qualité de sortie peut être trop dégradée pour l’entraînement. Pour obtenir un Modèle de Voix de meilleure qualité, utilisez si possible des Voix issues du Séparateur de stems.

</details>

<details>

<summary>Enregistrement des Échantillons</summary>

**Microphone de qualité avec interface Audio**

Les microphones professionnels avec interface Audio offrent des Voix de haute qualité. Vous aurez besoin d’un logiciel d’enregistrement pour connecter votre interface, enregistrer, éditer et mixer vos Voix.

Lors de l’enregistrement pour un Modèle de Voix, évitez les microphones qui ne sont pas conçus pour le chant :

* Micros de téléphone ou d’ordinateur portable
* Micros cravate ou de casque
* Micros de karaoké
* Micros d’écouteurs ou écouteurs Bluetooth comme les AirPods (ils sont généralement destinés aux appels téléphoniques)

**Environnement d’enregistrement**

1. Les bruits de fond indésirables peuvent inclure des personnes qui parlent, des bourdonnements et des grésillements électriques, le trafic et les bruits extérieurs, ainsi que les mouvements d’accessoires ou d’objets. Pour éviter que ces bruits n’interfèrent avec votre enregistrement, il est important de choisir un endroit calme. Choisissez un lieu où vous pouvez réduire au minimum, voire éliminer, les perturbations sonores inattendues.
2. Des réflexions sonores peuvent se produire en présence de surfaces dures et planes, entraînant de la réverbération ou des échos dans vos enregistrements. Cela peut donner à vos Pistes une qualité creuse ou lointaine, au détriment de l’intimité et de la clarté recherchées.
3. Essayez d’applaudir sèchement dans la pièce et écoutez attentivement. Si vous percevez un son de flottement ou un écho prolongé, cela indique la présence de problèmes de réverbération.
4. Pour y remédier, intégrez des matériaux Doux capables d’absorber le son. Pensez à utiliser des tapis, des moquettes ou de lourds rideaux pour réduire considérablement les réflexions. Recouvrir les sols durs et, si possible, suspendre des rideaux devant les fenêtres, ainsi qu’installer dans la pièce des meubles recouverts de tissu, peut être bénéfique.
5. Évitez d’utiliser des surfaces dures, car elles aggravent le problème. Si vous ne pouvez pas vous offrir des panneaux acoustiques professionnels, vous pouvez utiliser des objets du quotidien comme des toiles peintes, des tentures ou des dalles de mousse pour casser ces surfaces.
6. Lors de l’installation de votre microphone, soyez attentif à son emplacement. Évitez de le placer trop près des murs ou dans les coins. Visez plutôt le centre de la pièce ou testez différents emplacements pour trouver la zone optimale avec un minimum de réverbération.

**Repisse du casque**

Pendant les enregistrements, notamment lors de la prise de Voix, il est courant que l’Audio du casque repisse dans le microphone. Ce problème survient lorsque le volume du casque est trop élevé ou lorsque des casques ouverts sont utilisés. Cela peut être acceptable lors d’un enregistrement pour une chanson, mais essayez d’éviter cette repisse lors d’un enregistrement pour votre Modèle de Voix.

**Placement du microphone**

Pour un volume normal, il est recommandé de vous placer à environ 5 cm du microphone. En revanche, pour des phrases plus fortes ou en belting, il est conseillé d’augmenter la distance à environ 10 à 15 cm. Il est important de noter que vous devez toujours rester à moins de 30 cm du microphone afin de maintenir une capture Audio optimale.

> Créer de l’espace pour le belting
>
> Lorsque vous utilisez des techniques de belting, il est important de vous laisser suffisamment d’espace, tant au niveau de la distance avec le microphone que de la taille de la pièce. Une isolation sonore excessive, par exemple être confiné dans un placard ou une cabine, ou entourer votre microphone de mousse, peut facilement saturer la capsule du microphone. En cas de doute, il est conseillé d’intégrer davantage de son de pièce lors de l’interprétation de phrases en belting.

</details>

<details>

<summary>Langues de chant</summary>

**Emplacement personnalisé de base**

Une seule langue de chant sera prise en charge dans votre modèle vocal entraîné avec un emplacement personnalisé de base.

**Emplacement personnalisé Pro**

Votre voix entraînée avec un emplacement personnalisé Pro peut prendre en charge plusieurs langues.

**Langues dans vos échantillons**

Pendant le processus d'entraînement, chaque fichier d'échantillon sera traité individuellement et considéré comme un fichier monolingue. Il est important d'éviter de mélanger des phrases de différentes langues dans un même fichier d'échantillon.

Lors du téléversement des échantillons, veillez à les placer sous l'onglet de langue approprié. Même si vous téléversez des échantillons pour un emplacement personnalisé de base, vous pouvez si nécessaire téléverser des échantillons dans différentes langues. Conserver les échantillons organisés par langue aidera à maintenir la clarté et à améliorer le processus d'entraînement.

**Langues à venir**

Nous travaillons en continu au développement de nouvelles langues de chant pour la fonctionnalité de voix personnalisée.

Pour votre nouvelle voix :

* Les nouvelles langues seront prises en charge par les nouveaux emplacements personnalisés Pro.
* Les nouvelles langues feront partie des options prises en charge par les nouveaux emplacements personnalisés de base.

Pour votre voix existante :

* Les nouvelles langues seront prises en charge lors du réentraînement de vos emplacements personnalisés Pro.
* Les nouvelles langues seront facultatives lors du réentraînement de vos emplacements personnalisés de base.

</details>

<details>

<summary>Chant ou parole</summary>

Les échantillons de chant et les échantillons de parole peuvent tous deux être acceptés pour entraîner votre modèle de voix chantée.

Votre voix peut apprendre :

* Le timbre à partir de vos échantillons de chant et de parole, mais veuillez noter : pour une personne, le timbre de la parole peut être différent de celui du chant, et ne représente généralement pas la véritable performance chantée.
* Le style de chant à partir de vos échantillons de chant

Votre voix ne peut pas apprendre :

* Le style de chant à partir de vos échantillons de parole

</details>

<details>

<summary>Paramètres de qualité des fichiers</summary>

La qualité Audio de vos Échantillons influe directement sur la qualité de votre Voix.

Nous vous recommandons de régler votre qualité Audio sur :

* Profondeur de bits = 16 bits
* Taux d'échantillonnage = 44,1 kHz ou 48 kHz
* Format de fichier sans perte (.wav ou .flac)

</details>

<details>

<summary>Post-traitement</summary>

Pour préserver le caractère naturel et la clarté de votre Voix cible :

* **Pas de chevauchements :** Les Voix multicouches peuvent compliquer l’analyse de l’IA. Placez les prises superposées en arrière-plan et limitez-vous à une seule Piste vocale afin de garantir que l’IA puisse traiter et apprendre vos Échantillons avec précision.
* **Pas de coupures nettes :** Les coupures nettes peuvent créer des débuts ou des fins abrupts, inhabituels dans un chant naturel, et provoquer des clics ou des pops. Utilisez des fondus enchaînés doux au début et à la Fin du Clip vocal pour une transition plus naturelle.
* **Pas de sections dupliquées :** Les sections dupliquées n’aident pas à l’entraînement. Votre Modèle vocal bénéficie de la variation naturelle de l’interprétation.
* **Contrôlez le volume :** Assurez-vous que vos Échantillons restent autour de 30 à 50 % de votre vu-mètre. Utilisez un ajusteur de volume ou l’Automatisation pour garantir une cohérence des niveaux de volume sur l’ensemble de votre jeu de données. L’objectif est de créer un niveau de volume homogène sur l’enregistrement tout en conservant la dynamique à l’intérieur des sections.

</details>

### Entraîner votre Voix

Après avoir préparé vos jeux de données, vous pouvez aller sur <a href="https://acestudio.ai/app/custom-voice/vocal-synth" class="button secondary" data-icon="browser">Page de voix personnalisée</a> sélectionner un emplacement personnalisé, téléverser vos échantillons vocaux et lancer l'entraînement.

Un emplacement personnalisé de base vous offre une voix monolingue avec 5 versions.

Un emplacement personnalisé Pro vous offre une voix multilingue avec 5 versions.

Cliquez sur un emplacement pour commencer à téléverser vos Échantillons.

Une fois tous les échantillons téléversés, l'entraînement démarre automatiquement. Vous pouvez vérifier l'état en actualisant la page web.

Lorsque vous voyez que la page d'entraînement devient la page de gestion du clonage vocal, votre voix est prête. Elle apparaîtra dans votre bibliothèque de voix dans ACE Studio. Si elle n'apparaît pas, essayez de relancer ACE Studio.

{% hint style="info" %}
**Conseils de pro**

Si vous recherchez une performance et un caractère exclusifs pour une voix, par exemple les meilleurs résultats dans différentes tessitures ou émotions, il est préférable de répartir les échantillons entre plusieurs voix.

Voici un exemple :

Mike est un chanteur professionnel et souhaite personnaliser sa propre voix. Il peut chanter aussi bien en ténor qu'en basse. Il serait donc préférable d'entraîner 2 voix :

* Entraîner une voix aiguë et puissante à partir d'échantillons composés principalement d'interprétations aiguës et puissantes.
* Entraîner une voix basse à partir d'échantillons composés principalement de phrases graves.
  {% endhint %}

### Réentraînement de votre Voix

Cliquez sur le <kbd>Réentraîner</kbd> bouton pour réentraîner votre Voix.

Le réentraînement supprimera votre voix précédente sous cet emplacement et retirera tous les chanteurs déployés associés à cette voix. L'IA commencera à entraîner une toute nouvelle voix à partir de zéro en utilisant le nouveau jeu de données. Avant de lancer le processus de réentraînement, vous pouvez soit conserver les échantillons historiques dans cet emplacement et ajouter de nouveaux échantillons, soit effacer les échantillons historiques et n'utiliser que les nouveaux échantillons téléversés.

Lors de la préparation de nouveaux Échantillons, veuillez noter :

* Si la durée des échantillons ajoutés est nettement inférieure à celle des échantillons déjà téléversés — par exemple, ajouter 1 minute de nouvel échantillon à un jeu de données de 30 minutes — le réentraînement peut ne pas entraîner de changements significatifs dans les performances de la voix.
* Le réentraînement ne modifiera pas le type de votre emplacement.
* Vous pouvez changer la langue prise en charge de votre emplacement personnalisé de base en le réentraînant.

{% hint style="info" %}
**Quand dois-je réentraîner ma Voix ?**

* Lorsque vos jeux de données ont une meilleure qualité ou une plus grande quantité, vous pouvez les utiliser pour améliorer votre voix de manière itérative
* Lorsque vous n’êtes pas satisfait du résultat actuel et souhaitez ajuster vos jeux de données
* Lorsqu'une nouvelle compétence en langue de chant est publiée
  {% endhint %}

### Gestion de votre Voix

<details>

<summary>Versions</summary>

L'IA apprend progressivement à partir de vos données, en analysant chaque échantillon dans un processus étape par étape. À mesure que l'apprentissage s'approfondit, le nombre d'étapes augmente. L'entraînement avec un jeu de données de petite taille ou de qualité limitée, par exemple un jeu non conçu pour le chant mais pour la parole, peut ne nécessiter que quelques étapes. À l'inverse, un jeu de données plus vaste et plus diversifié peut nécessiter des étapes supplémentaires pour un ajustement plus complet. Cependant, un nombre excessif d'étapes d'entraînement peut entraîner un surapprentissage, ce qui risque de dégrader les performances de votre voix avec des résultats imprévisibles.

À la fin de l'entraînement, vous obtiendrez plusieurs versions basées sur différents niveaux d'entraînement, de Rare à Bien cuit. Vous pouvez trouver la meilleure version en changeant le déploiement et en les comparant.

</details>

<details>

<summary>Mélanger les voix</summary>

Le mélange des voix produit une voix hybride. Vous pouvez personnaliser votre voix pour qu'elle ressemble davantage à votre voix cible en ajustant les proportions des voix mélangées. Pour ce faire, accédez à la page de gestion des emplacements et cliquez sur le bouton « Mélanger les voix » situé sous chaque version.

Après le mélange, votre voix adoptera les nouvelles caractéristiques vocales. Pour appliquer ces changements, vous devrez actualiser votre voix en redémarrant ACE Studio.

</details>

<details>

<summary>Déployer vers ACE Studio</summary>

Pour les emplacements personnalisés de base et Pro, après avoir déployé une version, vous pouvez passer d'une version à une autre. Vous devez relancer ACE Studio après chaque déploiement pour actualiser votre bibliothèque de voix.

</details>


---

# Agent Instructions
This documentation is published with GitBook. GitBook is the documentation platform designed so that both humans and AI agents can read, navigate, and reason over technical content effectively. Learn more at gitbook.com.

## Querying This Documentation
If you need additional information that is not directly available in this page, you can query the documentation dynamically by asking a question.

Perform an HTTP GET request on the current page URL with the `ask` query parameter, and the optional `goal` query parameter:

```
GET https://docs.acestudio.ai/docs/product-wiki-fr/clonage-vocal/cloning-a-voice-for-vocal-synth.md?ask=<question>&goal=<endgoal>
```

`ask` is the immediate question: it should be specific, self-contained, and written in natural language.
`goal` is optional and describes the broader end goal you are ultimately trying to accomplish on behalf of the user. GitBook uses it to tailor the answer towards what is most useful for that goal.

The response will contain a direct answer to the question and relevant excerpts and sources from the documentation.

Use this mechanism when the answer is not explicitly present in the current page, you need clarification or additional context, or you want to retrieve related documentation sections.
