> For the complete documentation index, see [llms.txt](https://docs.acestudio.ai/llms.txt). Markdown versions of documentation pages are available by appending `.md` to page URLs; this page is available as [Markdown](https://docs.acestudio.ai/docs/product-wiki-pt/clonagem-de-voz/cloning-a-voice-for-vocal-synth.md).

# Clonando uma Voz para Vocal Synth

## O que é a clonagem de Sintetizador Vocal? <a href="#block-17608bffde808018b367cbddf8c9fe36" id="block-17608bffde808018b367cbddf8c9fe36"></a>

Este é um recurso para personalizar o seu próprio modelo de sintetizador vocal ao carregar as suas amostras vocais. A IA aprenderá o timbre e o estilo de canto com base nas amostras que carregar e criará uma versão digital clonada da sua voz.

Após a personalização, pode utilizar a sua voz para gerar vocais a partir de MIDI e letra, tal como as nossas vozes de IA pré-criadas no ACE Studio.

{% hint style="success" %}
A sua Voz de IA clonada é privada na sua conta; ninguém mais pode aceder a ela sem a sua autorização.
{% endhint %}

## Como clonar a minha voz para o Sintetizador Vocal? <a href="#block-17608bffde8080b98024eb3edc82d4d6" id="block-17608bffde8080b98024eb3edc82d4d6"></a>

### Preparando os seus conjuntos de dados

<details>

<summary>Vocais limpos e secos</summary>

Vozes de alta qualidade exigem Amostras de Vocais limpos e secos:

* Sem quaisquer efeitos de reverberação, delay ou chorus
* Sem ruído de fundo
* Sem instrumentais nem quaisquer sons não humanos
* Sem harmonias nem Dobras vocais

Recomendam-se 30-100 minutos de Amostras vocais cantadas para uma Voz. Quanto mais Amostras você fornecer, mais detalhes de canto a IA pode aprender, mas os benefícios são menores quando você ultrapassa os 120 minutos.

> Reflexões da sala
>
> Vocais gravados com grandes reflexões da sala podem causar reconhecimentos errados e resultar em desempenhos inesperados do Modelo.

> Vocais do Separador de Stems
>
> Quando estiver a usar um removedor de vocal ou o Separador de Stems para Vocais, a qualidade da saída pode ficar demasiado baixa para o treinamento. Para um Modelo de Voz de maior qualidade, use opcionalmente Vocais do Separador de Stems.

</details>

<details>

<summary>Gravação de Amostras</summary>

**Microfone de qualidade com interface de Áudio**

Microfones profissionais com interfaces de Áudio proporcionam Vocais de alta qualidade. Você precisará de software de gravação para conectar-se à sua interface, gravar, editar e mixar os seus Vocais.

Ao gravar para um Modelo de Voz, evite microfones que não foram feitos para canto:

* Microfones de telefone ou portátil
* Microfones de lapela ou headset
* Microfones de karaoke
* Microfones de auriculares ou auriculares Bluetooth como AirPods (estes são normalmente usados para chamadas telefónicas)

**Ambiente de gravação**

1. Ruídos de fundo indesejados podem incluir pessoas a falar, zumbidos e ruídos elétricos, trânsito e ruído exterior, bem como movimentos de acessórios ou objetos. Para evitar que esses ruídos interfiram na sua gravação, é importante selecionar um local silencioso. Escolha um lugar onde possa minimizar ou eliminar perturbações sonoras inesperadas.
2. As reflexões sonoras podem ocorrer devido à presença de superfícies duras e planas, resultando em reverberação ou ecos nas suas gravações. Isto pode dar às suas Faixas uma qualidade oca ou distante, prejudicando a intimidade e a clareza desejadas.
3. Experimente bater palmas com força na sala e ouça com atenção. Se perceber um som oscilante ou um eco prolongado, isso indica a presença de problemas de reverb.
4. Para resolver isto, incorpore materiais suaves que possam absorver o som. Considere usar carpetes, tapetes ou cortinas grossas para reduzir significativamente as reflexões. Cobrir pisos duros e, se possível, colocar cortinas nas janelas, bem como colocar mobiliário com revestimentos em tecido na sala, pode ser benéfico.
5. Evite usar superfícies duras, pois elas contribuem para o problema. Se não puder pagar painéis acústicos profissionais, pode utilizar objetos do dia a dia, como pinturas em Tela, tapeçarias ou placas de espuma, para quebrar essas superfícies.
6. Ao configurar o seu microfone, tenha atenção ao posicionamento. Evite colocá-lo demasiado perto das paredes ou nos cantos. Em vez disso, tente ficar no centro da sala ou experimente diferentes localizações para encontrar o ponto ideal com o mínimo de reverb.

**Vazamento dos auscultadores**

Durante as gravações, especialmente ao captar Vocais, é comum que o Áudio dos auscultadores vaze para o microfone. Este problema ocorre quando o volume dos auscultadores está demasiado alto ou quando estão a ser usados auscultadores de costas abertas. Isto pode ser aceitável ao gravar para uma música, mas tente evitar este vazamento ao gravar para o seu Modelo de Voz.

**Posicionamento do microfone**

Para volume normal, recomenda-se posicionar-se a cerca de 2 polegadas do microfone. No entanto, para frases mais fortes ou ao usar belting, é aconselhável aumentar a distância para cerca de 4-6 polegadas. É importante notar que deve permanecer sempre a menos de 12 polegadas do microfone para manter uma captação de Áudio ideal.

> Criando espaço para belting
>
> Ao utilizar técnicas de belting, é importante dar a si próprio espaço suficiente, tanto em termos de distância ao microfone como do tamanho da sala em que está. Um isolamento sonoro excessivo, como estar fechado num armário ou cabine, ou envolver o microfone em espuma, pode facilmente resultar em sobrecarga da cápsula do microfone. Se não tiver a certeza, é aconselhável incorporar mais som ambiente ao interpretar frases em belting.

</details>

<details>

<summary>Idiomas de canto</summary>

**Slot de personalização básico**

Apenas um idioma de canto será suportado no seu modelo de voz treinado num slot de personalização básico.

**Slot de personalização Pro**

A sua voz treinada num slot de personalização Pro pode ser multilingue.

**Idiomas nas suas amostras**

Durante o processo de treino, cada ficheiro de amostra será processado individualmente e tratado como um ficheiro de um único idioma. É importante evitar misturar frases de idiomas diferentes no mesmo ficheiro de amostra.

Ao carregar Amostras, certifique-se de que as coloca no separador de idioma adequado. Mesmo que esteja a carregar Amostras para um slot personalizado básico, tem a flexibilidade de carregar Amostras em diferentes idiomas, se necessário. Manter as Amostras organizadas por idioma ajudará a preservar a clareza e a melhorar o processo de treino.

**Próximos idiomas**

Estamos continuamente a trabalhar no desenvolvimento de novos idiomas de canto para a funcionalidade de Voz personalizada.

Para a sua nova Voz:

* Os novos idiomas serão suportados por novos slots personalizados pro.
* Os novos idiomas serão uma das opções suportadas pelos novos slots personalizados básicos.

Para a sua Voz existente:

* Os novos idiomas serão suportados ao voltar a treinar os seus slots personalizados pro.
* Os novos idiomas serão opcionais ao voltar a treinar os seus slots personalizados básicos.

</details>

<details>

<summary>Canto ou fala</summary>

Tanto Amostras de canto como Amostras de fala podem ser aceites para treinar o seu Modelo de Voz de canto.

Sua Voz pode aprender:

* Timbre das suas Amostras de canto e Amostras de fala, mas observe: para uma pessoa, o Timbre da fala pode ser diferente do canto, o que geralmente não representa a verdadeira performance de canto.
* Estilo de canto a partir das suas Amostras de canto

Sua Voz não pode aprender:

* Estilo de canto a partir das suas Amostras de fala

</details>

<details>

<summary>Configurações de qualidade dos ficheiros</summary>

A qualidade de Áudio das suas Amostras afeta diretamente a qualidade da sua Voz.

Recomendamos que defina a sua qualidade de Áudio em:

* Profundidade de Bits = 16-bit
* Taxa de amostragem = 44.1khz ou 48khz
* Formato de ficheiro sem perdas (.wav ou .flac)

</details>

<details>

<summary>Pós-processamento</summary>

Para manter o caráter natural e a clareza da sua Voz-alvo:

* **Sem sobreposições:** Vocais em várias camadas podem complicar a análise da IA. Coloque as tomadas sobrepostas ao fundo e mantenha-se numa única Faixa vocal para garantir que a IA possa processar e aprender com precisão a partir das suas Amostras.
* **Sem cortes bruscos:** cortes bruscos podem criar inícios ou fins abruptos, que não são normais num som de canto natural e podem introduzir cliques ou estalos. Use fades suaves no início e no fim do Clipe vocal para uma transição mais natural.
* **Sem duplicar secções:** Secções duplicadas não ajudam no treinamento. O seu Modelo de Voz beneficia da variação natural da performance.
* **Controle o volume:** Certifique-se de que as suas Amostras ficam em torno de 30-50% do seu medidor. Use um controlo de volume ou Automação para garantir que os níveis de volume sejam consistentes em todo o seu conjunto de dados. O objetivo é criar um nível de volume consistente ao longo da gravação, mantendo a dinâmica dentro das secções.

</details>

### Treinando a sua Voz

Depois de preparar os seus conjuntos de dados, você pode ir para <a href="https://acestudio.ai/app/custom-voice/vocal-synth" class="button secondary" data-icon="browser">Página de Voz Personalizada</a> para selecionar um Slot Personalizado, carregue suas Amostras Vocal e inicie o treinamento.

Um Slot Personalizado Básico oferece uma Voz monolíngue com 5 versões.

Um Slot Personalizado Pro oferece uma Voz multilíngue com 5 versões.

Clique num slot para começar a enviar as suas Amostras.

Depois que todas as Amostras forem enviadas, o treinamento começará automaticamente. Você pode verificar o status atualizando a página da web.

Quando você vir que a página de treinamento se transforma na página de gerenciamento de Clonagem de voz, sua Voz estará totalmente configurada. Ela será exibida na sua biblioteca de Voz no ACE Studio. Se você não conseguir vê-la, tente reiniciar o ACE Studio.

{% hint style="info" %}
**Dicas profissionais**

Se você busca uma performance e um caráter exclusivos para uma Voz, como os melhores resultados em diferentes registros vocais ou emoções, é melhor dividir as Amostras entre várias Vozes.

Aqui está um exemplo:

Mike é um cantor profissional e gostaria de personalizar a própria Voz. Ele se sai bem tanto como tenor quanto como Baixo. Portanto, seria melhor treinar 2 Vozes:

* Treine uma Voz aguda e potente com base em Amostras que sejam principalmente performances agudas e potentes.
* Treine uma Voz de Baixo com base em Amostras que sejam principalmente frases de tom grave.
  {% endhint %}

### Treinando novamente a sua Voz

Clique no <kbd>Re-treinar</kbd> botão para re-treinar a sua Voz.

O retreinamento removerá sua Voz anterior neste slot e desativará quaisquer cantores implantados associados à Voz. A IA começará a treinar uma nova Voz completamente do zero, usando o novo conjunto de dados. Antes de iniciar o processo de retreinamento, você tem a opção de manter as Amostras históricas neste slot e enviar Amostras novas adicionais, ou pode optar por limpar as Amostras históricas e usar apenas as Amostras recém-enviadas.

Ao preparar novas Amostras, note que:

* Se a Duração: das Amostras recém-adicionadas for significativamente menor do que a das Amostras já enviadas, por exemplo, adicionar 1 min de nova amostra a um conjunto de dados de 30 min, o retreinamento pode não trazer mudanças significativas no desempenho da Voz.
* O re-treinamento não alterará o tipo do seu slot.
* Você pode alterar o idioma compatível do seu slot personalizado básico por meio do retreinamento.

{% hint style="info" %}
**Quando devo re-treinar a minha Voz?**

* Quando seus conjuntos de dados tiverem melhor qualidade ou maior volume, você pode usá-los para aprimorar iterativamente sua Voz
* Quando não estiver satisfeito com o resultado atual e quiser ajustar os seus conjuntos de dados
* Quando uma nova habilidade de idioma de canto for lançada
  {% endhint %}

### Gerindo a sua Voz

<details>

<summary>Versões</summary>

A IA aprende de forma incremental a partir dos seus dados, analisando cada amostra em um processo passo a passo. À medida que o aprendizado se aprofunda, o número de etapas aumenta. O treinamento com um conjunto de dados pequeno ou de qualidade limitada, como um que não foi projetado para canto, mas para fala, pode exigir apenas algumas etapas. Em contrapartida, um conjunto de dados maior e mais diversificado pode exigir etapas adicionais para um ajuste mais completo. No entanto, um número excessivo de etapas de treinamento pode levar ao sobreajuste, potencialmente degradando o desempenho da sua voz com resultados imprevisíveis.

Ao Fim: do treinamento, você obterá várias versões com base em diferentes etapas de treinamento, de Rare a Well-done. Você pode encontrar a melhor versão alternando a implantação e comparando-as entre si.

</details>

<details>

<summary>Misturar Vozes</summary>

A mistura de vozes resulta em uma voz híbrida. Você pode personalizar sua voz para soar mais como a sua voz-alvo ajustando as proporções das Vozes Combinadas. Para fazer isso, navegue até a página de gerenciamento de slots e clique no botão ‘Misturar Vozes’ localizado abaixo de cada versão.

Após a mistura, sua voz adotará as novas características vocais. Para aplicar essas alterações, você precisará atualizar sua voz reiniciando o ACE Studio.

</details>

<details>

<summary>Implantar no ACE Studio</summary>

Para os slots personalizados Basic e Pro, após implantar uma versão, você pode alternar a implantação de uma versão para outra. Você precisa reiniciar o ACE Studio após cada implantação para atualizar sua biblioteca de vozes.

</details>


---

# Agent Instructions
This documentation is published with GitBook. GitBook is the documentation platform designed so that both humans and AI agents can read, navigate, and reason over technical content effectively. Learn more at gitbook.com.

## Querying This Documentation
If you need additional information that is not directly available in this page, you can query the documentation dynamically by asking a question.

Perform an HTTP GET request on the current page URL with the `ask` query parameter, and the optional `goal` query parameter:

```
GET https://docs.acestudio.ai/docs/product-wiki-pt/clonagem-de-voz/cloning-a-voice-for-vocal-synth.md?ask=<question>&goal=<endgoal>
```

`ask` is the immediate question: it should be specific, self-contained, and written in natural language.
`goal` is optional and describes the broader end goal you are ultimately trying to accomplish on behalf of the user. GitBook uses it to tailor the answer towards what is most useful for that goal.

The response will contain a direct answer to the question and relevant excerpts and sources from the documentation.

Use this mechanism when the answer is not explicitly present in the current page, you need clarification or additional context, or you want to retrieve related documentation sections.
