> For the complete documentation index, see [llms.txt](https://docs.acestudio.ai/llms.txt). Markdown versions of documentation pages are available by appending `.md` to page URLs; this page is available as [Markdown](https://docs.acestudio.ai/docs/product-wiki-it/clonazione-vocale/cloning-a-voice-for-vocal-synth.md).

# Clonazione di una voce per Sintesi Vocale

## Che cos'è la Clonazione di Sintesi Vocale? <a href="#block-17608bffde808018b367cbddf8c9fe36" id="block-17608bffde808018b367cbddf8c9fe36"></a>

Questa è una funzione per personalizzare il tuo Modello di Sintesi Vocale caricando i tuoi Campioni di Voce. L'IA apprenderà il Timbro e lo stile di canto in base ai Campioni che carichi, e clonerà una versione digitale della tua Voce.

Dopo la personalizzazione, puoi usare la tua Voce per generare Voci da MIDI e Testo, proprio come le nostre Voci AI predefinite in ACE Studio.

{% hint style="success" %}
La tua Voce IA clonata è privata nel tuo account e nessun altro può accedervi senza la tua autorizzazione.
{% endhint %}

## Come clonare la mia Voce per Sintesi Vocale? <a href="#block-17608bffde8080b98024eb3edc82d4d6" id="block-17608bffde8080b98024eb3edc82d4d6"></a>

### Preparazione dei dataset

<details>

<summary>Voci secca pulite</summary>

Le Voci di alta qualità richiedono Campioni vocali puliti e asciutti:

* Senza effetti di riverbero, delay o chorus
* Senza rumore di fondo
* Senza strumentali né altri suoni non umani
* Senza armonie né Doppi vocali

Per una Voce sono consigliati 30-100 minuti di Campioni vocali cantati. Più Campioni fornisci, più dettagli del canto l'IA potrà apprendere, ma i benefici diminuiscono oltre i 120 minuti.

> Riflessioni ambientali
>
> Le Voci registrate in ambienti con forti riflessioni possono causare errori di riconoscimento e prestazioni impreviste del Modello.

> Voci dal Separatore Stem
>
> Quando usi un remover vocale o un Separatore Stem per le Voci, la qualità dell'output potrebbe deteriorarsi troppo per l'addestramento. Per un Modello vocale di qualità superiore, usa preferibilmente Voci provenienti da Separatore Stem.

</details>

<details>

<summary>Registrazione dei Campioni</summary>

**Microfono di qualità con interfaccia Audio**

I microfoni professionali con interfacce Audio offrono Voci di alta qualità. Ti servirà un software di registrazione per collegarti all'interfaccia, registrare, modificare e mixare le Voci.

Quando registri per un Modello vocale, evita i microfoni non progettati per il canto:

* Microfoni di telefoni o laptop
* Microfoni a clip o per cuffie
* Microfoni da karaoke
* Microfoni degli auricolari o auricolari Bluetooth come gli AirPods (solitamente destinati alle chiamate telefoniche)

**Ambiente di registrazione**

1. I rumori di fondo indesiderati possono includere persone che parlano, ronzii e fruscii elettrici, traffico e rumori esterni, nonché movimenti di accessori o oggetti. Per evitare che questi rumori interferiscano con la registrazione, è importante scegliere un luogo silenzioso. Scegli un posto in cui puoi ridurre al minimo o eliminare disturbi sonori imprevisti.
2. Le riflessioni sonore possono verificarsi a causa della presenza di superfici dure e piane, generando riverbero o eco nelle registrazioni. Questo può conferire alle Tracce un suono vuoto o distante, compromettendo l'intimità e la chiarezza desiderate.
3. Prova a battere energicamente le mani nella stanza e ascolta con attenzione. Se percepisci un suono svolazzante o un'eco prolungata, indica la presenza di problemi di riverbero.
4. Per risolvere il problema, introduci materiali Morbido in grado di assorbire il suono. Valuta l'uso di moquette, tappeti o tende spesse per ridurre significativamente le riflessioni. Coprire i pavimenti duri e, se possibile, appendere tende alle finestre, oltre a collocare nella stanza mobili rivestiti in tessuto, può essere utile.
5. Evita di usare superfici dure, poiché contribuiscono al problema. Se non puoi permetterti pannelli acustici professionali, puoi utilizzare oggetti di uso quotidiano come dipinti su Tela, arazzi o piastrelle in schiuma per spezzare queste superfici.
6. Quando configuri il microfono, presta attenzione al suo posizionamento. Evita di collocarlo troppo vicino alle pareti o negli angoli. Cerca invece di posizionarti al centro della stanza o sperimenta diverse posizioni per trovare il punto ottimale con il minimo riverbero.

**Dispersione dalle cuffie**

Durante le registrazioni, soprattutto delle Voci, è comune che l'Audio delle cuffie venga captato dal microfono. Questo problema si verifica quando il volume delle cuffie è impostato troppo alto o quando si usano cuffie aperte. Può essere accettabile durante la registrazione di un brano, ma cerca di evitare questa dispersione quando registri per il tuo Modello vocale.

**Posizionamento del microfono**

Per un volume normale, si consiglia di posizionarsi a circa 2 pollici dal microfono. Tuttavia, per le frasi più forti o durante il belting, è consigliabile aumentare la distanza a circa 4-6 pollici. È importante rimanere sempre entro 12 pollici dal microfono per mantenere una cattura Audio ottimale.

> Creare spazio per il belting
>
> Quando utilizzi tecniche di belting, è importante disporre di spazio sufficiente, sia in termini di distanza dal microfono sia di dimensioni della stanza. Un isolamento acustico eccessivo, come stare confinati in un armadio o in una cabina, oppure circondare il microfono di schiuma, può facilmente sovraccaricare la capsula del microfono. In caso di dubbi, è consigliabile includere più suono ambientale durante l'esecuzione di frasi in belting.

</details>

<details>

<summary>Lingue di canto</summary>

**Slot personalizzato base**

Nel tuo Modello vocale addestrato con lo slot personalizzato base sarà supportata una sola lingua di canto.

**Slot personalizzato Pro**

La tua Voce addestrata con lo slot personalizzato Pro può supportare più lingue.

**Lingue nei tuoi Campioni**

Durante il processo di addestramento, ogni file di Campioni verrà elaborato singolarmente e trattato come un file in una sola lingua. È importante evitare di mescolare frasi di lingue diverse all'interno dello stesso file di Campioni.

Quando carichi i Campioni, assicurati di collocarli nella scheda della lingua appropriata. Anche se stai caricando Campioni per uno slot personalizzato base, hai la flessibilità di caricare Campioni in lingue diverse, se necessario. Mantenere i Campioni organizzati per lingua aiuterà a preservare la chiarezza e a migliorare il processo di addestramento.

**Lingue in arrivo**

Stiamo lavorando continuamente allo sviluppo di nuove lingue di canto per la funzione Voce personalizzata.

Per la tua nuova Voce:

* Le nuove lingue saranno supportate dai nuovi slot personalizzati Pro.
* Le nuove lingue saranno una delle opzioni supportate dai nuovi slot personalizzati base.

Per la tua Voce esistente:

* Le nuove lingue saranno supportate quando riaddestri i tuoi slot personalizzati Pro.
* Le nuove lingue saranno opzionali quando riaddestri i tuoi slot personalizzati base.

</details>

<details>

<summary>Canto o parlato</summary>

Sia i Campioni di canto sia i Campioni di parlato possono essere accettati per addestrare il tuo modello della tua Voce cantata.

La tua Voce può apprendere:

* Il Timbro dei tuoi Campioni di canto e dei tuoi Campioni di parlato, ma nota: per una persona, il Timbro del parlato può essere diverso da quello del canto e di solito non può rappresentare la vera performance del canto.
* Lo stile di canto dai tuoi Campioni di canto

La tua Voce non può apprendere:

* Lo stile di canto dai tuoi Campioni di parlato

</details>

<details>

<summary>Impostazioni della qualità dei file</summary>

La qualità Audio dei tuoi Campioni influisce direttamente sulla qualità della tua Voce.

Ti consigliamo di impostare la qualità Audio come segue:

* Profondità de bit = 16 bit
* Frequenza di campionamento = 44,1 kHz o 48 kHz
* Formato di file lossless (.wav o .flac)

</details>

<details>

<summary>Post-elaborazione</summary>

Per preservare il carattere naturale e la chiarezza della Voce di destinazione:

* **Nessuna sovrapposizione:** Le voci multistrato possono complicare l'analisi dell'IA. Porta le take sovrapposte in secondo piano e mantieniti su un'unica traccia vocale per garantire che l'IA possa elaborare e apprendere correttamente dai tuoi campioni.
* **Niente tagli netti:** i tagli netti possono creare inizi o fine improvvisi, che non sono naturali in un canto naturale e possono introdurre click o pop. Usa fade morbidi all'inizio e alla fine della clip vocale per una transizione più naturale.
* **Nessuna duplicazione di sezioni:** Le sezioni duplicate non aiutano l'addestramento. Il tuo modello vocale trae vantaggio dalla naturale variazione dell'esecuzione.
* **Controlla il volume:** Assicurati che i tuoi campioni rimangano intorno al 30-50% dell'indicatore. Usa un volume rider o l'automazione per garantire livelli di volume coerenti in tutto il dataset. L'obiettivo è creare un livello di volume uniforme lungo l'intera registrazione, mantenendo però la dinamica all'interno delle sezioni.

</details>

### Addestramento della tua voce

Dopo aver preparato i tuoi dataset, puoi andare a <a href="https://acestudio.ai/app/custom-voice/vocal-synth" class="button secondary" data-icon="browser">Pagina Voce Personalizzata</a> per selezionare uno Slot personalizzato, carica i tuoi Campioni di Voce e avvia l'addestramento.

Uno Slot personalizzato Base ti offre una Voce monolingue con 5 versioni.

Uno Slot personalizzato Pro ti offre una Voce multilingue con 5 versioni.

Fai clic su uno slot per iniziare a caricare i tuoi campioni.

Dopo che tutti i Campioni sono stati caricati, l'addestramento inizierà automaticamente. Puoi verificarne lo stato aggiornando la pagina web.

Quando vedi che la pagina di addestramento si trasforma nella pagina di gestione della Clonazione vocale, la tua Voce è pronta. Verrà mostrata nella tua libreria di Voci in ACE Studio. Se non la vedi, prova a riavviare ACE Studio.

{% hint style="info" %}
**Suggerimenti pro**

Se cerchi esclusività espressiva e carattere per una Voce, ad esempio i migliori risultati in diverse estensioni vocali o emozioni, è meglio dividere i Campioni tra più Voci.

Ecco un esempio:

Mike è un cantante professionista e vorrebbe personalizzare la propria Voce. Sa cavarsela bene sia come tenore sia come Basso. Quindi sarebbe meglio addestrare 2 Voci:

* Addestra una Voce acuta e potente basata su Campioni che sono per lo più interpretazioni acute e potenti.
* Addestra una Voce Basso basata su Campioni che sono per lo più frasi dal tono grave.
  {% endhint %}

### Riaddestrare la tua voce

Fai clic su <kbd>Riaddestra</kbd> pulsante per riaddestrare la tua voce.

Il riaddestramento rimuoverà la tua Voce precedente in questo slot e rimuoverà eventuali cantanti già distribuiti associati alla Voce. L'IA inizierà ad addestrare da zero una voce completamente nuova usando il nuovo dataset. Prima di avviare il processo di riaddestramento, hai la possibilità di mantenere i Campioni storici in questo slot e caricare nuovi Campioni aggiuntivi, oppure puoi scegliere di cancellare i Campioni storici e usare solo i nuovi Campioni caricati.

Quando prepari nuovi campioni, tieni presente:

* Se la durata dei Campioni appena aggiunti è significativamente inferiore a quella dei Campioni già caricati, per esempio aggiungendo 1 minuto di nuovi Campioni a un dataset di 30 minuti, il riaddestramento potrebbe non apportare cambiamenti significativi alle prestazioni della Voce.
* Il riaddestramento non cambierà il tipo del tuo slot.
* Puoi cambiare la lingua supportata del tuo slot personalizzato base tramite riaddestramento.

{% hint style="info" %}
**Quando dovrei riaddestrare la mia voce?**

* Quando i tuoi dataset hanno una qualità migliore o una quantità maggiore, puoi usarli per migliorare iterativamente la tua Voce
* Quando non sei soddisfatto del risultato attuale e vuoi modificare i tuoi dataset
* Quando viene rilasciata una nuova lingua di canto
  {% endhint %}

### Gestire la tua voce

<details>

<summary>Versioni</summary>

L'IA apprende in modo incrementale dai tuoi dati, analizzando ogni Campione in un processo passo dopo passo. Man mano che l'apprendimento si approfondisce, il numero di passaggi aumenta. L'addestramento con un dataset piccolo o di qualità limitata, ad esempio uno non pensato per il canto ma per il parlato, può richiedere solo pochi passaggi. Al contrario, un dataset più grande e più vario potrebbe richiedere passaggi aggiuntivi per un adattamento completo. Tuttavia, un numero eccessivo di passaggi di addestramento può portare a overfitting, degradando potenzialmente le prestazioni della tua Voce con esiti imprevedibili.

Alla fine dell'addestramento, otterrai diverse versioni basate su differenti passaggi di addestramento, da Rare a Well-done. Puoi trovare la versione migliore cambiando la distribuzione e confrontandole tra loro.

</details>

<details>

<summary>Mescola Voci</summary>

Mescolare le Voci produce una Voce ibrida. Puoi personalizzare la tua Voce per farla somigliare di più alla tua Voce di destinazione regolando i rapporti delle Voci Miste. Per farlo, vai alla pagina di gestione degli slot e fai clic sul pulsante 'Mescola Voci' situato sotto ciascuna versione.

Dopo la combinazione, la tua Voce adotterà le nuove caratteristiche vocali. Per applicare queste modifiche, dovrai aggiornare la tua Voce riavviando ACE Studio.

</details>

<details>

<summary>Distribuisci in ACE Studio</summary>

Per gli slot personalizzati Base e Pro, dopo aver distribuito una versione, puoi cambiare la distribuzione da una versione a un'altra. Devi riavviare ACE Studio dopo ogni distribuzione per aggiornare la tua libreria di Voci.

</details>


---

# Agent Instructions
This documentation is published with GitBook. GitBook is the documentation platform designed so that both humans and AI agents can read, navigate, and reason over technical content effectively. Learn more at gitbook.com.

## Querying This Documentation
If you need additional information that is not directly available in this page, you can query the documentation dynamically by asking a question.

Perform an HTTP GET request on the current page URL with the `ask` query parameter, and the optional `goal` query parameter:

```
GET https://docs.acestudio.ai/docs/product-wiki-it/clonazione-vocale/cloning-a-voice-for-vocal-synth.md?ask=<question>&goal=<endgoal>
```

`ask` is the immediate question: it should be specific, self-contained, and written in natural language.
`goal` is optional and describes the broader end goal you are ultimately trying to accomplish on behalf of the user. GitBook uses it to tailor the answer towards what is most useful for that goal.

The response will contain a direct answer to the question and relevant excerpts and sources from the documentation.

Use this mechanism when the answer is not explicitly present in the current page, you need clarification or additional context, or you want to retrieve related documentation sections.
