> For the complete documentation index, see [llms.txt](https://docs.acestudio.ai/llms.txt). Markdown versions of documentation pages are available by appending `.md` to page URLs; this page is available as [Markdown](https://docs.acestudio.ai/docs/product-wiki-pt/clonagem-de-voz/cloning-a-voice-for-vocal-synth.md).

# Clonando uma Voz para Vocal Synth

## O que é a Clonagem de Sintetizador Vocal? <a href="#block-17608bffde808018b367cbddf8c9fe36" id="block-17608bffde808018b367cbddf8c9fe36"></a>

Este é um recurso para personalizar seu próprio Modelo de sintetizador vocal enviando suas Amostras Vocais. A IA aprenderá o Timbre e o estilo de canto com base nas Amostras que você enviar e clonará uma versão digital da sua Voz.

Após a personalização, você poderá usar sua Voz para gerar Vocais a partir de MIDI e Letra, assim como as nossas Vozes de IA pré-criadas no ACE Studio.

{% hint style="success" %}
A sua voz de IA clonada é privada na sua conta; ninguém mais pode acessá-la sem a sua autorização.
{% endhint %}

## Como clonar minha Voz para o Sintetizador Vocal? <a href="#block-17608bffde8080b98024eb3edc82d4d6" id="block-17608bffde8080b98024eb3edc82d4d6"></a>

### Preparando os seus conjuntos de dados

<details>

<summary>Vocais secos e limpos</summary>

Vozes de alta qualidade exigem amostras vocais limpas e secas:

* Sem qualquer efeito de reverb, delay ou chorus
* Sem ruído de fundo
* Sem instrumentais nem quaisquer sons não humanos
* Sem quaisquer harmonias ou dobras vocais

Recomendam-se de 30 a 100 minutos de amostras vocais cantadas para uma voz. Quanto mais amostras você fornecer, mais detalhes de canto a IA poderá aprender, mas os benefícios são menores quando você ultrapassa 120 minutos.

> Reflexões da sala
>
> Vocais gravados com fortes reflexões da sala podem causar reconhecimentos incorretos e resultar em desempenhos inesperados do modelo.

> Vocais do Separador de Stems
>
> Ao usar um removedor de vocal ou o Separador de Stems para vocais, a qualidade da saída pode ficar danificada e baixa demais para o treinamento. Para um modelo de voz de maior qualidade, use, opcionalmente, vocais do Separador de Stems.

</details>

<details>

<summary>Gravação de amostras</summary>

**Microfone de qualidade com interface de áudio**

Microfones profissionais com interfaces de áudio proporcionam vocais de alta qualidade. Você precisará de software de gravação para conectar-se à sua interface, gravar, editar e mixar os seus vocais.

Ao gravar para um modelo de voz, evite microfones que não foram projetados para canto:

* Microfones de telefone ou laptop
* Microfones de lapela ou de headsets
* Microfones de karaokê
* Microfones de fone de ouvido ou fones Bluetooth como AirPods (normalmente usados para chamadas telefônicas)

**Ambiente de gravação**

1. Ruídos indesejados de fundo podem incluir pessoas falando, zumbidos e chiados elétricos, trânsito e ruídos externos, bem como movimentos de acessórios ou objetos. Para evitar que esses ruídos interfiram na sua gravação, é importante selecionar um local silencioso. Escolha um lugar onde você possa minimizar ou eliminar perturbações sonoras inesperadas.
2. Reflexões sonoras podem ocorrer devido à presença de superfícies duras e planas, resultando em reverberação ou ecos nas suas gravações. Isso pode dar às suas faixas uma qualidade oca ou distante, prejudicando a intimidade e a clareza desejadas.
3. Tente bater palmas com força no ambiente e ouvir atentamente. Se você perceber um som oscilante ou um eco prolongado, isso indica a presença de problemas de reverb.
4. Para resolver isso, incorpore materiais suaves que possam absorver som. Considere usar carpetes, tapetes ou cortinas grossas para reduzir significativamente as reflexões. Cobrir pisos duros e, se possível, pendurar cortinas nas janelas, além de colocar móveis com revestimento de tecido no ambiente, pode ser benéfico.
5. Evite usar superfícies duras, pois elas contribuem para o problema. Se você não puder investir em painéis acústicos profissionais, pode usar itens do dia a dia, como quadros em Tela, tapeçarias ou placas de espuma, para quebrar essas superfícies.
6. Ao configurar o seu microfone, tenha atenção ao posicionamento. Evite colocá-lo muito perto das paredes ou nos cantos. Em vez disso, mire no centro da sala ou experimente diferentes locais para encontrar o ponto ideal com reverb mínimo.

**Vazamento de fones de ouvido**

Durante as gravações, especialmente ao capturar vocais, é comum que o áudio dos fones de ouvido vaze para o microfone. Esse problema ocorre quando o volume dos fones está muito alto ou quando se usam fones de ouvido abertos. Isso pode ser aceitável ao gravar uma música, mas tente evitar esse vazamento ao gravar para o seu modelo de voz.

**Posicionamento do microfone**

Para volume normal, recomenda-se posicionar-se a cerca de 2 polegadas do microfone. No entanto, para frases mais fortes ou ao fazer belting, é aconselhável aumentar a distância para cerca de 4 a 6 polegadas. É importante notar que você deve sempre ficar a menos de 12 polegadas do microfone para manter a captação de áudio ideal.

> Criando espaço para o belting
>
> Ao usar técnicas de belting, é importante permitir espaço suficiente, tanto em termos de distância do microfone quanto do tamanho do ambiente em que você está. O isolamento sonoro excessivo, como ficar confinado em um closet ou cabine, ou cercar o microfone com espuma, pode facilmente sobrecarregar a cápsula do microfone. Se você não tiver certeza, é aconselhável incorporar mais som ambiente ao executar frases com belting.

</details>

<details>

<summary>Idiomas do canto</summary>

**Slot de personalização básico**

Apenas um idioma de canto será compatível com o seu Modelo de Voz treinado no slot de personalização básico.

**Slot de personalização Pro**

Sua Voz treinada no slot de personalização Pro pode ser multilíngue.

**Idiomas nas suas Amostras**

Durante o processo de treinamento, cada arquivo de amostra será processado individualmente e tratado como um arquivo de idioma único. É importante evitar misturar frases de idiomas diferentes no mesmo arquivo de amostra.

Ao enviar Amostras, certifique-se de colocá-las na aba de idioma apropriada. Mesmo que esteja enviando Amostras para um slot personalizado básico, você tem a flexibilidade de enviar Amostras em diferentes idiomas, se necessário. Manter as Amostras organizadas por idioma ajudará a manter a clareza e a melhorar o processo de treinamento.

**Idiomas futuros**

Estamos trabalhando continuamente no desenvolvimento de novos idiomas de canto para o recurso de Voz personalizada.

Para a sua nova Voz:

* Novos idiomas serão suportados por novos slots personalizados Pro.
* Novos idiomas serão uma das opções suportadas pelos novos slots personalizados básicos.

Para a sua Voz existente:

* Novos idiomas serão suportados ao retreinar seus slots personalizados Pro.
* Novos idiomas serão opcionais ao retreinar seus slots personalizados básicos.

</details>

<details>

<summary>Canto ou fala</summary>

Amostras de canto e Amostras de fala podem ser aceitas para treinar seu Modelo de Voz de canto.

Sua Voz pode aprender:

* Timbre das suas Amostras de canto e Amostras de fala, mas observe: para uma pessoa, o Timbre da fala pode ser diferente do canto, o que geralmente não pode representar a verdadeira performance de canto.
* Estilo de canto a partir das suas Amostras de canto

Sua Voz não pode aprender:

* Estilo de canto a partir das suas Amostras de fala

</details>

<details>

<summary>Configurações de qualidade dos arquivos</summary>

A qualidade de áudio das suas amostras impacta diretamente a qualidade da sua voz.

Recomendamos definir a qualidade do áudio em:

* Profundidade de Bits = 16 bits
* Taxa de amostragem = 44,1 kHz ou 48 kHz
* Formato de arquivo sem perdas (.wav ou .flac)

</details>

<details>

<summary>Pós-processamento</summary>

Para manter o caráter natural e a clareza da sua voz-alvo:

* **Sem sobreposições:** Vocais em camadas podem complicar a análise da IA. Coloque as takes sobrepostas ao fundo e mantenha uma única faixa vocal para garantir que a IA possa processar e aprender com precisão a partir das suas amostras.
* **Sem cortes bruscos:** cortes bruscos podem criar inícios ou finais abruptos, o que não é normal em um canto natural e pode introduzir cliques ou estouros. Use fades suaves no início e no fim do clipe vocal para uma transição mais natural.
* **Sem duplicar seções:** Seções duplicadas não ajudam no treinamento. O seu modelo de voz beneficia da variação natural da performance.
* **Controle o volume:** Certifique-se de que suas amostras fiquem em torno de 30 a 50% do medidor. Use um volume rider ou Automação para garantir que os níveis de volume sejam consistentes em todo o seu conjunto de dados. O objetivo é criar um nível de volume consistente ao longo da gravação, mantendo a dinâmica dentro das seções.

</details>

### Treinando a sua voz

Depois de preparar os seus conjuntos de dados, você pode ir para <a href="https://acestudio.ai/app/custom-voice/vocal-synth" class="button secondary" data-icon="browser">Página de Voz Personalizada</a> para selecionar um Slot Personalizado, carregue suas Amostras Vocal e inicie o treinamento.

Um Slot Personalizado Básico oferece uma Voz monolíngue com 5 versões.

Um Slot Personalizado Pro oferece uma Voz multilíngue com 5 versões.

Clique em um slot para começar a enviar as suas amostras.

Depois de todas as Amostras serem carregadas, o treinamento começará automaticamente. Você pode verificar o status atualizando a página.

Quando você vir a página de treinamento se transformar na página de gerenciamento de Clonagem de voz, sua Voz estará pronta. Ela será exibida na sua biblioteca de Voz no ACE Studio. Se não conseguir vê-la, tente reiniciar o ACE Studio.

{% hint style="info" %}
**Dicas profissionais**

Se você busca desempenho e caráter exclusivos para uma Voz, como os melhores resultados em diferentes faixas vocais ou emoções. Seria melhor dividir as Amostras entre várias Vozes.

Aqui está um exemplo:

Mike é um cantor profissional e gostaria de personalizar sua própria Voz. Ele se sai bem tanto como tenor quanto como Baixo. Então seria melhor treinar 2 Vozes:

* Treine uma Voz aguda e poderosa com base em Amostras que sejam, em sua maioria, performances agudas e potentes.
* Treine uma Voz de Baixo com base em Amostras que sejam, em sua maioria, frases de tom grave.
  {% endhint %}

### Retreinando a sua voz

Clique no <kbd>Retreinar</kbd> botão para retreinar a sua voz.

O retraining removerá sua Voz anterior neste slot e desativará quaisquer cantores implantados associados à Voz. A IA começará a treinar uma Voz totalmente nova do zero, usando o novo conjunto de dados. Antes de iniciar o processo de retraining, você tem a opção de manter as Amostras históricas neste slot e fazer upload de novas Amostras adicionais, ou pode optar por limpar as Amostras históricas e usar apenas as Amostras recém-enviadas.

Ao preparar novas amostras, observe:

* Se a duração das Amostras recém-adicionadas for significativamente menor do que as Amostras já enviadas, por exemplo, adicionar 1 min de nova Amostra a um conjunto de dados de 30 min, o retraining pode não trazer mudanças significativas no desempenho da Voz.
* O retreinamento não mudará o tipo do seu slot.
* Você pode alterar o idioma suportado do seu slot personalizado básico por meio do retraining.

{% hint style="info" %}
**Quando devo retreinar a minha voz?**

* Quando seus conjuntos de dados tiverem melhor qualidade ou maior quantidade, você pode usá-los para aprimorar iterativamente a sua Voz
* Quando você não estiver satisfeito com o resultado atual e quiser ajustar os seus conjuntos de dados
* Quando uma nova habilidade de idioma de canto estiver sendo lançada
  {% endhint %}

### Gerenciando a sua voz

<details>

<summary>Versões</summary>

A IA aprende de forma incremental com os seus dados, analisando cada amostra em um processo passo a passo. À medida que o aprendizado se aprofunda, o número de etapas aumenta. O treinamento com um conjunto de dados pequeno ou de qualidade limitada, como um que não foi projetado para canto, mas para fala, pode exigir apenas algumas etapas. Em contraste, um conjunto de dados maior e mais diversificado pode exigir etapas adicionais para um ajuste mais completo. No entanto, etapas de treinamento excessivas podem levar ao sobreajuste, potencialmente degradando o desempenho da sua voz com परिणामados imprevisíveis.

Ao final do treinamento, você terá várias versões com base em diferentes etapas de treinamento, de Mal passada a Bem passada. Você pode encontrar a melhor versão alternando a implantação e comparando-as entre si.

</details>

<details>

<summary>Misturar Vozes</summary>

Misturar Vozes resulta em uma Voz híbrida. Você pode personalizar sua Voz para soar mais como sua Voz-alvo ajustando as proporções das Vozes combinadas. Para fazer isso, vá para a página de gerenciamento de slots e clique no botão ‘Misturar Vozes’ localizado abaixo de cada versão.

Após a mistura, sua Voz adotará as novas características da Voz. Para aplicar essas alterações, será necessário atualizar sua Voz reiniciando o ACE Studio.

</details>

<details>

<summary>Implantar no ACE Studio</summary>

Para slots personalizados Basic e slots personalizados Pro, após implantar uma versão, você pode alternar a implantação de uma versão para outra. É necessário reiniciar o ACE Studio após cada implantação para atualizar sua biblioteca de Vozes.

</details>


---

# Agent Instructions
This documentation is published with GitBook. GitBook is the documentation platform designed so that both humans and AI agents can read, navigate, and reason over technical content effectively. Learn more at gitbook.com.

## Querying This Documentation
If you need additional information that is not directly available in this page, you can query the documentation dynamically by asking a question.

Perform an HTTP GET request on the current page URL with the `ask` query parameter, and the optional `goal` query parameter:

```
GET https://docs.acestudio.ai/docs/product-wiki-pt/clonagem-de-voz/cloning-a-voice-for-vocal-synth.md?ask=<question>&goal=<endgoal>
```

`ask` is the immediate question: it should be specific, self-contained, and written in natural language.
`goal` is optional and describes the broader end goal you are ultimately trying to accomplish on behalf of the user. GitBook uses it to tailor the answer towards what is most useful for that goal.

The response will contain a direct answer to the question and relevant excerpts and sources from the documentation.

Use this mechanism when the answer is not explicitly present in the current page, you need clarification or additional context, or you want to retrieve related documentation sections.
