> For the complete documentation index, see [llms.txt](https://docs.acestudio.ai/llms.txt). Markdown versions of documentation pages are available by appending `.md` to page URLs; this page is available as [Markdown](https://docs.acestudio.ai/docs/product-wiki-it/clonazione-vocale/cloning-a-voice-for-vocal-synth.md).

# Clonazione di una Voce per Sintesi Vocale

Clona la tua voce come Voce di Sintesi Vocale in ACE Studio.

## Che cos’è la clonazione della Sintesi Vocale? <a href="#block-17608bffde808018b367cbddf8c9fe36" id="block-17608bffde808018b367cbddf8c9fe36"></a>

Questa funzione consente di personalizzare il tuo Modello di Sintesi Vocale caricando i tuoi Campioni vocali. L’IA apprenderà il Timbro e lo stile di canto in base ai Campioni caricati e clonerà una versione digitale della tua Voce.

Dopo la personalizzazione, potrai usare la tua Voce per generare Voci da MIDI e Testo, proprio come le nostre Voci AI preimpostate in ACE Studio.

{% hint style="success" %}
La tua voce IA clonata è privata nel tuo account; nessun altro può accedervi senza la tua autorizzazione.
{% endhint %}

## Come clonare la mia Voce per la Sintesi Vocale? <a href="#block-17608bffde8080b98024eb3edc82d4d6" id="block-17608bffde8080b98024eb3edc82d4d6"></a>

### Preparazione dei tuoi dataset

<details>

<summary>Voci secche e pulite</summary>

Le voci di alta qualità richiedono campioni vocali puliti e secchi:

* Senza alcun effetto di riverbero, delay o chorus
* Senza rumore di fondo
* Senza strumentali o altri suoni non umani
* Senza armonie o doppi vocali

30-100 minuti di campioni vocali cantati sono raccomandati per una voce. Più campioni fornisci, più dettagli del canto l’IA può apprendere, ma i vantaggi diminuiscono quando superi i 120 minuti.

> Riflessioni della stanza
>
> Le voci registrate con forti riflessioni della stanza potrebbero causare riconoscimenti errati e portare a prestazioni del modello imprevedibili.

> Voci da Separatore Stem
>
> Quando usi un rimuovi voce o Separatore Stem per le voci, la qualità dell’output potrebbe risultare troppo bassa per l’addestramento. Per un modello vocale di qualità superiore, usa facoltativamente le voci da Separatore Stem.

</details>

<details>

<summary>Registrazione dei campioni</summary>

**Microfono di qualità con interfaccia audio**

I microfoni professionali con interfacce audio offrono voci di alta qualità. Ti servirà un software di registrazione per collegarti alla tua interfaccia, registrare, modificare e mixare le tue voci.

Quando registri per un modello vocale, evita microfoni non pensati per il canto:

* Microfoni del telefono o del laptop
* Microfoni lavalier o da auricolare
* Microfoni da karaoke
* Microfoni degli auricolari o auricolari Bluetooth come AirPods (di solito sono pensati per le chiamate telefoniche)

**Ambiente di registrazione**

1. I rumori di fondo indesiderati possono includere persone che parlano, ronzii e brusii elettrici, traffico e rumori esterni, oltre ai movimenti di accessori o oggetti. Per evitare che questi rumori interferiscano con la registrazione, è importante scegliere un luogo silenzioso. Scegli uno spazio in cui ridurre al minimo o eliminare disturbi sonori imprevisti.
2. Le riflessioni sonore possono verificarsi a causa della presenza di superfici dure e piane, generando riverbero o echi nelle registrazioni. Questo può dare alle tue tracce una qualità ovattata o distante, togliendo intimità e chiarezza al risultato desiderato.
3. Prova ad applaudire con decisione nella stanza e ascolta con attenzione. Se percepisci un suono fluttuante o un’eco prolungata, significa che ci sono problemi di riverbero.
4. Per risolvere il problema, integra materiali morbidi in grado di assorbire il suono. Valuta di usare tappeti, moquette o tende pesanti per ridurre in modo significativo le riflessioni. Coprire i pavimenti duri e, se possibile, appendere tende alle finestre, oltre a inserire nell’ambiente arredi rivestiti in tessuto, può essere utile.
5. Evita di usare superfici dure, perché contribuiscono al problema. Se non puoi permetterti pannelli acustici professionali, puoi utilizzare oggetti di uso quotidiano come quadri su tela, arazzi o pannelli in schiuma per spezzare queste superfici.
6. Quando configuri il microfono, fai attenzione alla sua posizione. Evita di collocarlo troppo vicino alle pareti o negli angoli. Punta invece al centro della stanza o prova diverse posizioni per trovare il punto ottimale con un riverbero minimo.

**Rientro in cuffia**

Durante le registrazioni, soprattutto quando si catturano le voci, è comune che l’audio delle cuffie finisca nel microfono. Questo problema si verifica quando il volume delle cuffie è troppo alto o quando si usano cuffie open-back. Può essere accettabile durante la registrazione di un brano, ma cerca di evitare questo rientro quando registri per il tuo modello vocale.

**Posizionamento del microfono**

Per un volume normale, si consiglia di posizionarsi a circa 2 pollici dal microfono. Tuttavia, per frasi più intense o quando si canta in voce piena, è consigliabile aumentare la distanza a circa 4-6 pollici. È importante notare che dovresti restare sempre entro i 12 pollici dal microfono per mantenere una cattura audio ottimale.

> Creare spazio per il canto in voce piena
>
> Quando utilizzi tecniche di canto in voce piena, è importante concederti spazio sufficiente, sia in termini di distanza dal microfono sia di dimensioni della stanza in cui ti trovi. Un isolamento eccessivo, ad esempio essere confinato in un armadio o in una cabina, o circondare il microfono con della schiuma, può facilmente portare a un sovraccarico della capsula microfonica. Se non sei sicuro, è consigliabile integrare più ambiente nella registrazione quando esegui frasi in voce piena.

</details>

<details>

<summary>Lingue del canto</summary>

**Slot personalizzato Basic**

Solo una lingua di canto sarà supportata nel tuo Modello di Voce addestrato nello slot personalizzato Basic.

**Slot personalizzato Pro**

La tua Voce addestrata nello slot personalizzato Pro potrà diventare multilingue.

**Lingue nei tuoi Campioni**

Durante il processo di addestramento, ogni file Campione verrà elaborato singolarmente e trattato come un file monolingue. È importante evitare di mescolare frasi di lingue diverse all’interno dello stesso file Campione.

Quando carichi i Campioni, assicurati di inserirli nella scheda della lingua corretta. Anche se stai caricando Campioni per uno slot personalizzato Basic, hai la flessibilità di caricare Campioni in lingue diverse, se necessario. Tenere i Campioni organizzati per lingua aiuterà a mantenere chiarezza e a migliorare il processo di addestramento.

**Lingue in arrivo**

Stiamo lavorando costantemente allo sviluppo di nuove lingue di canto per la funzione di Voce personalizzata.

Per la tua nuova Voce:

* Le nuove lingue saranno supportate dai nuovi slot personalizzati Pro.
* Le nuove lingue saranno una delle opzioni supportate dai nuovi slot personalizzati Basic.

Per la tua Voce esistente:

* Le nuove lingue saranno supportate quando riaddestri i tuoi slot personalizzati Pro.
* Le nuove lingue saranno opzionali quando riaddestri i tuoi slot personalizzati Basic.

</details>

<details>

<summary>Canto o parlato</summary>

Sia i Campioni di canto sia i Campioni di parlato possono essere accettati per addestrare il tuo Modello di Voce cantata.

La tua Voce può apprendere:

* Il Timbro dai tuoi Campioni di canto e dai tuoi Campioni di parlato, ma nota bene: per una persona, il Timbro del parlato può essere diverso da quello del canto, e di solito non può rappresentare la vera performance di canto.
* Stile di canto dai tuoi Campioni di canto

La tua Voce non può apprendere:

* Stile di canto dai tuoi Campioni di parlato

</details>

<details>

<summary>Impostazioni della qualità dei file</summary>

La qualità audio dei tuoi campioni influisce direttamente sulla qualità della tua voce.

Ti consigliamo di impostare la qualità audio su:

* Profondità de bit = 16 bit
* Frequenza di campionamento = 44,1 kHz o 48 kHz
* Formato file senza perdita (.wav o .flac)

</details>

<details>

<summary>Post-produzione</summary>

Per mantenere il carattere naturale e la chiarezza della voce di destinazione:

* **Nessuna sovrapposizione:** Le voci multilivello possono complicare l’analisi dell’IA. Porta le take sovrapposte in secondo piano e atteniti a un’unica traccia vocale per garantire che l’IA possa elaborare e apprendere dai tuoi campioni con precisione.
* **Nessun taglio netto:** I tagli netti possono creare attacchi o finali bruschi, non naturali in un suono cantato e possono introdurre click o pop. Usa dissolvenze morbide all’inizio e alla fine del clip vocale per una transizione più naturale.
* **Nessuna duplicazione di sezioni:** Le sezioni duplicate non aiutano nell’addestramento. Il tuo modello vocale trae vantaggio dalla naturale variabilità dell’interpretazione.
* **Controlla il volume:** Assicurati che i tuoi campioni restino intorno al 30-50% del tuo misuratore. Usa un fader del volume o l’Automazione per assicurarti che i livelli di volume siano coerenti in tutto il dataset. L’obiettivo è creare un livello di volume uniforme lungo tutta la registrazione, mantenendo la dinamica all’interno delle sezioni.

</details>

### Addestramento della tua voce

Dopo aver preparato i tuoi dataset, puoi andare alla <a href="https://acestudio.ai/app/custom-voice/vocal-synth" class="button secondary" data-icon="browser">Pagina della voce personalizzata</a> per selezionare uno Slot personalizzato, carica i tuoi Campioni vocali e avvia l’addestramento.

Uno Slot personalizzato Basic ti offre una Voce monolingue con 5 versioni.

Uno Slot personalizzato Pro ti offre una Voce multilingue con 5 versioni.

Fai clic su uno slot per iniziare a caricare i tuoi campioni.

Dopo aver caricato tutti i Campioni, l’addestramento inizierà automaticamente. Puoi controllarne lo stato aggiornando la pagina web.

Quando vedi che la pagina di addestramento si trasforma nella pagina di gestione della Clonazione vocale, la tua Voce è pronta. Verrà mostrata nella tua libreria delle Voci in ACE Studio. Se non riesci a vederla, prova a riavviare ACE Studio.

{% hint style="info" %}
**Consigli avanzati**

Se stai cercando una performance esclusiva e un carattere unico per una Voce, ad esempio i migliori risultati in diverse estensioni vocali o emozioni, è meglio dividere i Campioni per più Voci.

Ecco un esempio:

Mike è un cantante professionista e vorrebbe personalizzare la propria Voce. Sa cavarsela bene sia come tenore sia come Basso. Quindi sarebbe meglio addestrare 2 Voci:

* Addestra una Voce acuta e potente basandoti su Campioni che sono per lo più interpretazioni acute e potenti.
* Addestra una Voce da Basso basandoti su Campioni che sono per lo più frasi dal Timbro grave.
  {% endhint %}

### Riaddestramento della tua voce

Fai clic sul <kbd>Riaddestra</kbd> pulsante per riaddestrare la tua voce.

Il riaddestramento rimuoverà la tua Voce precedente in questo slot e rimuoverà eventuali cantanti distribuiti associati alla Voce. L’IA inizierà ad addestrare da zero una Voce completamente nuova usando il nuovo dataset. Prima di avviare il processo di riaddestramento, hai la possibilità di mantenere i Campioni storici in questo slot e caricare nuovi Campioni aggiuntivi, oppure puoi scegliere di cancellare i Campioni storici e usare solo i Campioni caricati di recente.

Quando prepari nuovi campioni, tieni presente:

* Se la durata dei Campioni aggiunti di recente è significativamente inferiore a quella dei Campioni già caricati, per esempio aggiungere 1 min di nuovi Campioni a un dataset di 30 min, il riaddestramento potrebbe non portare cambiamenti significativi nelle prestazioni della Voce.
* Il riaddestramento non cambierà il tipo del tuo slot.
* Puoi cambiare la lingua supportata del tuo slot personalizzato Basic tramite riaddestramento.

{% hint style="info" %}
**Quando dovrei riaddestrare la mia voce?**

* Quando i tuoi dataset hanno una qualità migliore o una quantità maggiore, puoi usarli per migliorare iterativamente la tua Voce
* Quando non sei soddisfatto del risultato attuale e vuoi modificare i tuoi dataset
* Quando viene rilasciata una nuova competenza di canto in una lingua
  {% endhint %}

### Gestione della tua voce

<details>

<summary>Versioni</summary>

L’IA apprende in modo incrementale dai tuoi dati, analizzando ogni Campione in un processo passo dopo passo. Man mano che l’apprendimento si approfondisce, il numero di passaggi aumenta. L’addestramento con un dataset piccolo o di qualità limitata, ad esempio uno non pensato per il canto ma per il parlato, può richiedere solo pochi passaggi. Al contrario, un dataset più ampio e vario potrebbe richiedere passaggi aggiuntivi per un adattamento completo. Tuttavia, un numero eccessivo di passaggi di addestramento può portare a overfitting, degradando potenzialmente le prestazioni della tua Voce con risultati imprevedibili.

Alla fine dell’addestramento otterrai diverse versioni basate su differenti passaggi di addestramento, da Rare a Well-done. Puoi trovare la versione migliore cambiando la distribuzione e confrontandole tra loro.

</details>

<details>

<summary>Mescola Voci</summary>

La combinazione delle Voci Miste produce una Voce ibrida. Puoi personalizzare la tua Voce per farla assomigliare di più alla Voce di riferimento regolando le proporzioni delle Voci Miste. Per farlo, vai alla pagina di gestione degli slot e fai clic sul pulsante ‘Mescola Voci’ situato sotto ogni versione.

Dopo la mescolanza, la tua Voce adotterà le nuove caratteristiche vocali. Per applicare queste modifiche, dovrai aggiornare la tua Voce riavviando ACE Studio.

</details>

<details>

<summary>Distribuisci in ACE Studio</summary>

Per gli slot personalizzati Basic e gli slot personalizzati Pro, dopo aver distribuito una versione, puoi cambiare la distribuzione da una versione all’altra. Devi riavviare ACE Studio dopo ogni distribuzione per aggiornare la tua libreria delle Voci.

</details>


---

# Agent Instructions
This documentation is published with GitBook. GitBook is the documentation platform designed so that both humans and AI agents can read, navigate, and reason over technical content effectively. Learn more at gitbook.com.

## Querying This Documentation
If you need additional information that is not directly available in this page, you can query the documentation dynamically by asking a question.

Perform an HTTP GET request on the current page URL with the `ask` query parameter, and the optional `goal` query parameter:

```
GET https://docs.acestudio.ai/docs/product-wiki-it/clonazione-vocale/cloning-a-voice-for-vocal-synth.md?ask=<question>&goal=<endgoal>
```

`ask` is the immediate question: it should be specific, self-contained, and written in natural language.
`goal` is optional and describes the broader end goal you are ultimately trying to accomplish on behalf of the user. GitBook uses it to tailor the answer towards what is most useful for that goal.

The response will contain a direct answer to the question and relevant excerpts and sources from the documentation.

Use this mechanism when the answer is not explicitly present in the current page, you need clarification or additional context, or you want to retrieve related documentation sections.
