> For the complete documentation index, see [llms.txt](https://docs.acestudio.ai/llms.txt). Markdown versions of documentation pages are available by appending `.md` to page URLs; this page is available as [Markdown](https://docs.acestudio.ai/docs/product-wiki-es/clonacion-de-voz/cloning-a-voice-for-voice-changer.md).

# Clonación de una Voz para Cambiador de voz

## ¿Qué es la clonación con Cambiador de voz?

Esta es una función para personalizar tu propia voz de cambiador de voz subiendo tus muestras. La IA aprenderá el timbre a partir de las muestras que subas y clonará una versión digital de esta voz.

Después de la personalización, puedes usar tu perfil para convertir voces a partir de audio, igual que las voces predefinidas del cambiador de voz con IA en ACE Studio.

{% hint style="success" %}
Tu voz de IA clonada es privada en tu cuenta; nadie más puede acceder a ella sin tu autorización.
{% endhint %}

## ¿Cómo clono mi Voz para el Cambiador de voz?

### Preparación de tus conjuntos de datos

<details>

<summary>Voces secas limpias</summary>

Las voces de alta calidad requieren muestras vocales limpias y secas:

* Sin efectos de reverberación, retardo ni coro
* Sin ruido de fondo
* Sin instrumentales ni sonidos no humanos
* Sin armonías ni Dobles vocales

Se recomiendan entre 30 y 100 minutos de muestras vocales cantadas para una voz. Cuantas más muestras proporciones, más detalles de canto podrá aprender la IA, pero los beneficios adicionales serán menores al superar los 120 minutos.

> Reflexiones de la sala
>
> Las Voces grabadas con muchas reflexiones de sala pueden provocar reconocimientos erróneos y dar lugar a un rendimiento inesperado del modelo.

> Voces de un Separador de pistas
>
> Al usar un eliminador vocal o un Separador de pistas para voces, la calidad de salida puede deteriorarse demasiado para el entrenamiento. Para obtener un modelo de voz de mayor calidad, utiliza preferiblemente voces de un Separador de pistas.

</details>

<details>

<summary>Grabación de muestras</summary>

**Micrófono de calidad con interfaz de audio**

Los micrófonos profesionales con interfaces de audio proporcionan voces de alta calidad. Necesitarás software de grabación para conectarte a tu interfaz, grabar, editar y mezclar tus voces.

Al grabar para un modelo de voz, evita micrófonos que no estén diseñados para cantar:

* Micrófonos de teléfono o portátil
* Micrófonos de solapa o de diadema
* Micrófonos de karaoke
* Micrófonos de auriculares o auriculares Bluetooth como los AirPods (normalmente se usan para llamadas telefónicas)

**Entorno de grabación**

1. Los ruidos de fondo no deseados pueden incluir conversaciones, zumbidos eléctricos, tráfico y ruido exterior, así como movimientos de accesorios u objetos. Para evitar que estos ruidos interfieran en tu grabación, es importante elegir un lugar silencioso. Escoge un lugar donde puedas minimizar o eliminar perturbaciones sonoras inesperadas.
2. Las reflexiones sonoras pueden producirse por la presencia de superficies duras y planas, generando reverberación o ecos en tus grabaciones. Esto puede dar a tus pistas una cualidad hueca o distante, restando intimidad y claridad.
3. Prueba a dar una palmada seca en la sala y escucha atentamente. Si percibes un sonido vibrante o un eco prolongado, indica la presencia de problemas de reverberación.
4. Para solucionarlo, incorpora materiales suaves que puedan absorber el sonido. Considera usar moquetas, alfombras o cortinas gruesas para reducir significativamente las reflexiones. Cubrir los suelos duros y, si es posible, colgar cortinas sobre las ventanas, así como colocar muebles con revestimientos de tela en la sala, puede ser beneficioso.
5. Evita usar superficies duras, ya que contribuyen al problema. Si no puedes permitirte paneles acústicos profesionales, puedes utilizar objetos cotidianos como pinturas sobre lienzo, tapices o baldosas de espuma para interrumpir estas superficies.
6. Al instalar el micrófono, presta atención a su ubicación. Evita colocarlo demasiado cerca de las paredes o en esquinas. En su lugar, intenta situarlo en el centro de la sala o experimenta con diferentes ubicaciones para encontrar el punto óptimo con la mínima reverberación.

**Filtración de auriculares**

Durante las grabaciones, especialmente al capturar voces, es común que el audio de los auriculares se filtre al micrófono. Este problema surge cuando el volumen de los auriculares está demasiado alto o cuando se utilizan auriculares abiertos. Puede ser aceptable al grabar una canción, pero intenta evitar esta filtración al grabar para tu modelo de voz.

**Ubicación del micrófono**

Para un volumen normal, se recomienda situarte a unas 2 pulgadas del micrófono. Sin embargo, para frases más fuertes o al cantar con belting, se aconseja aumentar la distancia a unas 4-6 pulgadas. Es importante tener en cuenta que siempre debes permanecer a menos de 12 pulgadas del micrófono para mantener una captura de audio óptima.

> Crear espacio para el belting
>
> Al utilizar técnicas de belting, es importante disponer de suficiente espacio, tanto en términos de distancia al micrófono como del tamaño de la sala. Un aislamiento acústico excesivo, como estar confinado en un armario o cabina, o rodear el micrófono con espuma, puede sobrecargar fácilmente la cápsula del micrófono. Si no estás seguro, es aconsejable incorporar más sonido de sala al interpretar frases con belting.

</details>

<details>

<summary>Idiomas de canto</summary>

Para una voz de cambiador de voz, no necesitas mantener todas las muestras en un solo idioma.

</details>

<details>

<summary>Canto o habla</summary>

Para una voz de cambiador de voz, no hay mucha diferencia entre las muestras de habla y las de canto. Pero para una voz de cambiador de voz para canto, es más adecuado utilizar muestras de canto para el entrenamiento.

</details>

<details>

<summary>Configuración de calidad de archivo</summary>

La calidad de audio de tus muestras afecta directamente a la calidad de tu voz.

Te recomendamos configurar la calidad de audio así:

* Profundidad de bits = 16 bits
* Frecuencia de muestreo = 44,1 kHz o 48 kHz
* Formato de archivo sin pérdida (.wav o .flac)

</details>

<details>

<summary>Posprocesamiento</summary>

Para mantener el carácter natural y la claridad de tu voz objetivo:

* **Sin solapamientos:** las voces multicapa pueden complicar el análisis de la IA. Coloca las tomas solapadas al fondo y utiliza una única pista vocal para garantizar que la IA pueda procesar y aprender con precisión de tus muestras.
* **Sin cortes bruscos:** los cortes bruscos pueden crear inicios o finales abruptos, que no son normales en un sonido de canto natural y pueden introducir clics o chasquidos. Usa fundidos suaves al inicio y al final del Clip vocal para lograr una transición más natural.
* **Sin duplicar secciones:** Las secciones duplicadas no ayudan al entrenamiento. Tu modelo de voz se beneficia de la variación natural de la interpretación.
* **Controla el volumen:** Asegúrate de que tus muestras se mantengan alrededor del 30-50 % de tu medidor. Usa un control automático de volumen o Automatización para asegurarte de que los niveles de volumen sean uniformes en todo tu conjunto de datos. El objetivo es crear un nivel de volumen uniforme en toda la grabación, manteniendo la dinámica dentro de las secciones.

</details>

### Entrenamiento de tu Voz

Después de preparar tus conjuntos de datos, puedes ir a <a href="https://acestudio.ai/app/custom-voice/voice-changer" class="button secondary" data-icon="browser">Página de Voz personalizada</a> para seleccionar una ranura personalizada, subir tus muestras e iniciar el entrenamiento.

Puedes personalizar una voz de cambiador de voz en una ranura personalizada.

Haz clic en una ranura para empezar a subir tus muestras.

Una vez que se hayan subido todas las muestras, el entrenamiento comenzará automáticamente. Puedes consultar su estado actualizando la página web.

Cuando la página vuelva a la lista de ranuras con una nueva voz entrenada, estará todo listo.

Haz clic en «Abrir en ACE» para abrir ACE Studio y usar tu nueva voz entrenada.

### Reentrenamiento de tu Voz

Haz clic en el <kbd>Reentrenar</kbd> botón para reentrenar tu voz.

El reentrenamiento eliminará tu voz anterior de esta ranura. La IA comenzará a entrenar una voz completamente nueva desde cero utilizando el nuevo conjunto de datos. Antes de iniciar el proceso de reentrenamiento, puedes conservar las muestras históricas de esta ranura y subir muestras nuevas adicionales, o puedes eliminar las muestras históricas y utilizar solo las muestras recién subidas.

Al preparar muestras nuevas, ten en cuenta lo siguiente:

* Si la duración de las muestras añadidas recientemente es significativamente menor que la de las muestras ya subidas, por ejemplo, al añadir 1 minuto de muestra nueva a un conjunto de datos de 30 minutos, el reentrenamiento puede no producir cambios significativos en el rendimiento.
* El reentrenamiento no cambiará el tipo de tu ranura.

{% hint style="info" %}
**¿Cuándo debería reentrenar mi voz?**

* Cuando tus conjuntos de datos tengan mejor calidad o mayor cantidad que antes, puedes utilizarlos para mejorar iterativamente tu voz.
* Cuando no estés satisfecho con el resultado actual y quieras ajustar tus conjuntos de datos
  {% endhint %}

### Gestión de tu Voz

Haz clic en el <kbd>Gestionar</kbd> botón para abrir la ventana de gestión de una voz personalizada del cambiador de voz. En esa ventana, puedes modificar:

* Imagen de Voz
* Nombre de Voz
* Etiquetas
* Tipo de Voz
* Etiqueta de idioma (solo para el tipo de voz)

Después de realizar los cambios, puedes hacer clic en <kbd>Abrir en ACE</kbd> botón para actualizar la lista de voces de ACE Studio.


---

# Agent Instructions
This documentation is published with GitBook. GitBook is the documentation platform designed so that both humans and AI agents can read, navigate, and reason over technical content effectively. Learn more at gitbook.com.

## Querying This Documentation
If you need additional information that is not directly available in this page, you can query the documentation dynamically by asking a question.

Perform an HTTP GET request on the current page URL with the `ask` query parameter, and the optional `goal` query parameter:

```
GET https://docs.acestudio.ai/docs/product-wiki-es/clonacion-de-voz/cloning-a-voice-for-voice-changer.md?ask=<question>&goal=<endgoal>
```

`ask` is the immediate question: it should be specific, self-contained, and written in natural language.
`goal` is optional and describes the broader end goal you are ultimately trying to accomplish on behalf of the user. GitBook uses it to tailor the answer towards what is most useful for that goal.

The response will contain a direct answer to the question and relevant excerpts and sources from the documentation.

Use this mechanism when the answer is not explicitly present in the current page, you need clarification or additional context, or you want to retrieve related documentation sections.
