> For the complete documentation index, see [llms.txt](https://docs.acestudio.ai/llms.txt). Markdown versions of documentation pages are available by appending `.md` to page URLs; this page is available as [Markdown](https://docs.acestudio.ai/docs/product-wiki-pt/clonagem-de-voz/cloning-a-voice-for-vocal-synth.md).

# Clonagem de uma Voz para Vocal Synth

Clone a sua própria voz como uma voz do Vocal Synth no ACE Studio.

## O que é Vocal Synth Cloning? <a href="#block-17608bffde808018b367cbddf8c9fe36" id="block-17608bffde808018b367cbddf8c9fe36"></a>

Esta é uma funcionalidade para personalizar o seu próprio modelo de sintetizador vocal carregando as suas Amostras Vocais. A IA aprenderá o Timbre e o estilo de canto com base nas Amostras que carregar e criará uma versão digital da sua Voz.

Após a personalização, você pode usar sua Voz para gerar Vocais a partir de MIDI e Letra, assim como nossas Vozes de IA pré-criadas no ACE Studio.

{% hint style="success" %}
A sua voz de IA clonada é privada na sua conta; ninguém mais pode aceder a ela sem a sua autorização.
{% endhint %}

## Como Clonar Minha Voz para Vocal Synth? <a href="#block-17608bffde8080b98024eb3edc82d4d6" id="block-17608bffde8080b98024eb3edc82d4d6"></a>

### Preparando os seus conjuntos de dados

<details>

<summary>Vocais limpos e secos</summary>

Vozes de alta qualidade exigem Amostras vocais limpas e secas:

* Sem quaisquer efeitos de reverb, delay ou chorus
* Sem ruído de fundo
* Sem instrumentais nem quaisquer sons não humanos
* Sem quaisquer harmonias ou dobras vocais

Recomendam-se 30-100 min de Amostras vocais de canto para uma voz. Quanto mais Amostras você fornecer, mais detalhes de canto a IA pode aprender, mas os benefícios diminuem quando você ultrapassa 120 minutos.

> Reflexões da sala
>
> Vocais gravados com fortes reflexões da sala podem causar reconhecimentos incorretos e resultar em comportamentos inesperados do Modelo.

> Vocais do Separador de Stems
>
> Quando você estiver a usar um removedor de vocal ou o Separador de Stems para Vocais, a qualidade da saída pode ficar demasiado baixa para o treinamento. Para um Modelo de voz de maior qualidade, use opcionalmente Vocais do Separador de Stems.

</details>

<details>

<summary>Gravando Amostras</summary>

**Microfone de qualidade com interface de Áudio**

Microfones profissionais com interfaces de Áudio oferecem Vocais de alta qualidade. Você precisará de software de gravação para se ligar à sua interface, gravar, editar e mixar os seus Vocais.

Ao gravar para um Modelo de voz, evite microfones que não foram feitos para canto:

* Microfones de telemóvel ou portátil
* Microfones de lapela ou de headset
* Microfones de karaoke
* Microfones de auriculares ou auriculares Bluetooth como AirPods (estes são normalmente para chamadas telefónicas)

**Ambiente de gravação**

1. Ruídos de fundo indesejados podem incluir pessoas a falar, zumbidos e chiados elétricos, tráfego e ruído exterior, bem como movimentos de acessórios ou objetos. Para evitar que estes ruídos interfiram com a sua gravação, é importante selecionar um local silencioso. Escolha um lugar onde possa minimizar ou eliminar perturbações sonoras inesperadas.
2. As reflexões sonoras podem ocorrer devido à presença de superfícies duras e planas, resultando em reverberação ou ecos nas suas gravações. Isto pode dar às suas Faixas uma qualidade oculta ou distante, prejudicando a intimidade e a clareza desejadas.
3. Experimente bater palmas de forma seca na sala e ouvir com atenção. Se perceber um som oscilante ou um eco prolongado, isso indica a presença de problemas de reverb.
4. Para resolver isto, incorpore materiais suaves que possam absorver o som. Considere usar carpetes, tapetes ou cortinas espessas para reduzir significativamente as reflexões. Cobrir pisos duros e, se possível, colocar cortinas nas janelas, bem como móveis com revestimentos de tecido na sala, pode ser benéfico.
5. Evite usar superfícies duras, pois estas contribuem para o problema. Se não puder pagar painéis acústicos profissionais, pode utilizar itens do dia a dia, como pinturas em Tela, tapeçarias ou placas de espuma, para quebrar essas superfícies.
6. Ao configurar o seu microfone, tenha cuidado com o seu posicionamento. Evite colocá-lo demasiado perto de paredes ou em cantos. Em vez disso, procure o centro da sala ou experimente diferentes locais para encontrar o ponto ideal com reverb mínimo.

**Vazamento dos auscultadores**

Durante as gravações, especialmente ao captar Vocais, é comum o áudio dos auscultadores vazar para o microfone. Este problema surge quando o volume dos auscultadores está demasiado alto ou quando estão a ser usados auscultadores abertos. Isto pode ser aceitável ao gravar para uma música, mas tente evitar esse vazamento ao gravar para o seu Modelo de voz.

**Posicionamento do microfone**

Para volume normal, recomenda-se posicionar-se a cerca de 2 polegadas do microfone. No entanto, para frases mais intensas ou ao fazer belting, é aconselhável aumentar a distância para cerca de 4-6 polegadas. É importante notar que deve manter-se sempre a menos de 12 polegadas do microfone para manter a captação de áudio ideal.

> Criando espaço para o belting
>
> Ao aplicar técnicas de belting, é importante dar a si próprio bastante espaço, tanto em termos de distância ao microfone como do tamanho da sala em que está. O isolamento sonoro excessivo, como estar confinado num armário ou cabine, ou rodear o microfone com espuma, pode facilmente resultar em sobrecarga da cápsula do microfone. Se não tiver a certeza, é aconselhável incorporar mais som da sala ao executar frases em belting.

</details>

<details>

<summary>Idiomas de canto</summary>

**Slot personalizado básico**

Apenas um idioma de canto será suportado no seu Modelo de Voz treinado no slot personalizado básico.

**Slot personalizado Pro**

A sua Voz treinada no slot personalizado Pro pode tornar-se multilíngue.

**Idiomas nas suas Amostras**

Durante o processo de treino, cada ficheiro de amostra será processado individualmente e tratado como um ficheiro de um único idioma. É importante evitar misturar frases de idiomas diferentes no mesmo ficheiro de amostra.

Ao enviar Amostras, certifique-se de colocá-las na guia de idioma apropriada. Mesmo ao enviar Amostras para um slot custom básico, você tem a flexibilidade de enviar Amostras em diferentes idiomas, se necessário. Manter as Amostras organizadas por idioma ajudará a manter a clareza e a melhorar o processo de treinamento.

**Próximos idiomas**

Estamos trabalhando continuamente no desenvolvimento de novos idiomas de canto para o recurso de Voz personalizada.

Para sua nova Voz:

* Novos idiomas serão compatíveis com os novos slots custom pro.
* Novos idiomas estarão entre as opções compatíveis com os novos slots custom básicos.

Para sua Voz existente:

* Novos idiomas serão suportados ao retreinar seus slots custom pro.
* Novos idiomas serão opcionais ao retreinar seus slots custom básicos.

</details>

<details>

<summary>Canto ou fala</summary>

Amostras de canto e Amostras de fala podem ser aceitas para treinar seu Modelo de Voz de canto.

A sua Voz pode aprender:

* Timbre das suas Amostras de canto e Amostras de fala, mas observe: para uma pessoa, o timbre da fala pode ser diferente do canto, o que geralmente não consegue representar a verdadeira performance vocal.
* Estilo de canto a partir das suas Amostras de canto

A sua Voz não pode aprender:

* Estilo de canto a partir das suas Amostras de fala

</details>

<details>

<summary>Configurações de qualidade do ficheiro</summary>

A qualidade de Áudio das suas Amostras impacta diretamente a qualidade da sua Voz.

Recomendamos que defina a sua qualidade de Áudio para:

* Profundidade de Bits = 16 bits
* Taxa de amostragem = 44,1 kHz ou 48 kHz
* Formato de ficheiro sem perdas (.wav ou .flac)

</details>

<details>

<summary>Pós-processamento</summary>

Para manter o caráter natural e a clareza da sua voz-alvo:

* **Sem sobreposições:** Vocais em múltiplas camadas podem complicar a análise da IA. Coloque as tomadas sobrepostas no fundo e mantenha-se numa única Faixa vocal para garantir que a IA possa processar e aprender com precisão a partir das suas Amostras.
* **Sem cortes bruscos:** cortes bruscos podem criar inícios ou fins abruptos, o que não é normal num som de canto natural e pode introduzir cliques ou pops. Use fades suaves no início e no fim do Clipe vocal para uma transição mais natural.
* **Sem duplicar secções:** Secções duplicadas não ajudam no treinamento. O seu Modelo de voz beneficia da variação natural da performance.
* **Controle o volume:** Certifique-se de que as suas Amostras se mantêm em torno de 30-50% do seu medidor. Use um ajustador de volume ou Automação para garantir que os níveis de volume sejam consistentes em todo o seu conjunto de dados. O objetivo é criar um nível de volume consistente ao longo da gravação, mantendo a dinâmica dentro das secções.

</details>

### Treinando a sua voz

Depois de preparar os seus conjuntos de dados, pode ir para <a href="https://acestudio.ai/app/custom-voice/vocal-synth" class="button secondary" data-icon="browser">Página de Voz Personalizada</a> para selecionar um Slot Personalizado, carregue suas Amostras vocais e inicie o treinamento.

Um Slot Personalizado Básico oferece a você uma Voz monolíngue com 5 versões.

Um Slot Personalizado Pro oferece a você uma Voz multilíngue com 5 versões.

Clique num slot para começar a enviar as suas Amostras.

Depois que todas as Amostras forem carregadas, o treinamento começará automaticamente. Você pode verificar o status atualizando a página da web.

Quando você vir a página de treinamento se transformar na página de gerenciamento de Clonagem de voz, sua Voz estará pronta. Ela será exibida na sua biblioteca de Voz em ACE Studio. Se você não conseguir vê-la, tente reiniciar o ACE Studio.

{% hint style="info" %}
**Dicas profissionais**

Se você estiver buscando desempenho e caráter exclusivos para uma Voz, como os melhores resultados em diferentes faixas Vocal ou emoções, seria melhor dividir as Amostras entre várias Vozes.

Aqui está um exemplo:

Mike é um cantor profissional e gostaria de personalizar sua própria Voz. Ele se sai bem tanto como tenor quanto como Baixo. Portanto, seria melhor treinar 2 Vozes:

* Treine uma Voz aguda e potente com base em Amostras que sejam, em sua maioria, performances agudas e potentes.
* Treine uma Voz de Baixo com base em Amostras que sejam, em sua maioria, frases graves.
  {% endhint %}

### Re-treinando a sua voz

Clique em <kbd>Re-treinar</kbd> botão para re-treinar a sua voz.

O retraining removerá sua Voz anterior neste slot e desativará quaisquer cantores implantados associados à Voz. A IA começará a treinar uma Voz completamente nova do zero usando o novo conjunto de dados. Antes de iniciar o processo de retraining, você tem a opção de manter as Amostras históricas neste slot e enviar Amostras adicionais novas, ou pode optar por limpar as Amostras históricas e usar apenas as Amostras recém-enviadas.

Ao preparar novas Amostras, note que:

* Se a Duração: das Amostras recém-adicionadas for significativamente menor do que as Amostras já enviadas, por exemplo, adicionar 1 min de uma Amostra a um conjunto de dados de 30 min, o retraining pode não trazer mudanças significativas no desempenho da Voz.
* O re-treino não alterará o tipo do seu slot.
* Você pode alterar o idioma suportado do seu slot personalizado básico por meio de retraining.

{% hint style="info" %}
**Quando devo re-treinar a minha voz?**

* Quando seus conjuntos de dados tiverem melhor qualidade ou maior quantidade, você pode usá-los para melhorar iterativamente sua Voz
* Quando não estiver satisfeito com o resultado atual e quiser ajustar os seus conjuntos de dados
* Quando uma nova habilidade de idioma para canto é lançada
  {% endhint %}

### Gerindo a sua voz

<details>

<summary>Versões</summary>

A IA aprende de forma incremental com seus dados, analisando cada amostra em um processo passo a passo. À medida que o aprendizado se aprofunda, o número de etapas aumenta. O treinamento com um conjunto de dados pequeno ou de qualidade limitada, como um não projetado para canto, mas para fala, pode exigir apenas algumas etapas. Em contraste, um conjunto de dados maior e mais diverso pode exigir etapas adicionais para um ajuste completo. No entanto, etapas excessivas de treinamento podem levar ao overfitting, potencialmente degradando o desempenho da sua Voz com resultados imprevisíveis.

Ao final do treinamento, você obterá várias versões com base em diferentes etapas de treinamento, de Raro a Bem-passado. Você pode encontrar a melhor versão alternando a implantação e comparando-as entre si.

</details>

<details>

<summary>Misturar Vozes</summary>

A combinação de Vozes resulta em uma Voz híbrida. Você pode personalizar sua Voz para soar mais como sua Voz-alvo ajustando as proporções das Vozes Combinadas. Para isso, vá para a página de gerenciamento de slots e clique no botão ‘Misturar Vozes’ localizado abaixo de cada versão.

Após a combinação, sua Voz assumirá as novas características de Voz. Para aplicar essas alterações, será necessário recarregar sua Voz reiniciando o ACE Studio.

</details>

<details>

<summary>Implantar no ACE Studio</summary>

Para slots personalizados Básicos e slots personalizados Pro, após implantar uma versão, você pode alternar a implantação de uma versão para outra. Você precisa reiniciar o ACE Studio após cada implantação para atualizar sua biblioteca de Vozes.

</details>


---

# Agent Instructions
This documentation is published with GitBook. GitBook is the documentation platform designed so that both humans and AI agents can read, navigate, and reason over technical content effectively. Learn more at gitbook.com.

## Querying This Documentation
If you need additional information that is not directly available in this page, you can query the documentation dynamically by asking a question.

Perform an HTTP GET request on the current page URL with the `ask` query parameter, and the optional `goal` query parameter:

```
GET https://docs.acestudio.ai/docs/product-wiki-pt/clonagem-de-voz/cloning-a-voice-for-vocal-synth.md?ask=<question>&goal=<endgoal>
```

`ask` is the immediate question: it should be specific, self-contained, and written in natural language.
`goal` is optional and describes the broader end goal you are ultimately trying to accomplish on behalf of the user. GitBook uses it to tailor the answer towards what is most useful for that goal.

The response will contain a direct answer to the question and relevant excerpts and sources from the documentation.

Use this mechanism when the answer is not explicitly present in the current page, you need clarification or additional context, or you want to retrieve related documentation sections.
