Clonación de una voz para Cambiador de voz
Clona tu propia voz como voz de Cambiador de voz en ACE Studio.
¿Qué es la clonación del Cambiador de voz?
Esta es una función para personalizar tu propia Voz del Cambiador de voz cargando tus Muestras. La IA aprenderá el Timbre según las Muestras que subas y clonará una versión digital de esta Voz.
Después de la personalización, puedes usar tu perfil para convertir Voces desde Audio, igual que nuestras Voces del Cambiador de voz predefinidas con IA en ACE Studio.
Tu Voz de IA clonada es privada dentro de tu cuenta; nadie más puede acceder a ella sin tu autorización.
¿Cómo clono mi Voz para el Cambiador de voz?
Preparación de tus conjuntos de datos
Voces limpias y secas
Las Voces de alta calidad requieren Muestras vocales limpias y secas:
Sin reverberación, retardo ni efectos de coro
Sin ruido de fondo
Sin instrumentales ni sonidos no humanos
Sin armonías ni Dobles vocales
Se recomiendan entre 30 y 100 minutos de Muestras vocales cantadas para una Voz. Cuantas más Muestras proporciones, más detalles de canto puede aprender la IA, pero aporta menos beneficios cuando superas los 120 minutos.
Reflexiones de la sala
Las Voces grabadas con grandes reflexiones de la sala pueden provocar errores de reconocimiento y dar lugar a un rendimiento inesperado del Modelo.
Voces del Separador de pistas
Cuando uses un eliminador de vocales o el Separador de pistas para Voces, la calidad de salida podría degradarse demasiado para el entrenamiento. Para un Modelo de Voz de mayor calidad, usa opcionalmente Voces del Separador de pistas.
Grabación de Muestras
Micrófono de calidad con interfaz de Audio
Los micrófonos profesionales con interfaces de Audio ofrecen Voces de alta calidad. Necesitarás software de grabación para conectar tu interfaz, grabar, editar y mezclar tus Voces.
Al grabar para un Modelo de Voz, evita los micrófonos que no están diseñados para cantar:
Micrófonos de teléfono o portátil
Micrófonos de solapa o de auriculares
Micrófonos de karaoke
Micrófonos de auriculares o auriculares Bluetooth como AirPods (normalmente se usan para llamadas telefónicas)
Entorno de grabación
Los ruidos de fondo no deseados pueden incluir personas hablando, zumbidos eléctricos, tráfico y ruido exterior, así como movimientos de accesorios u objetos. Para evitar que estos ruidos interfieran con tu grabación, es importante elegir un lugar tranquilo. Busca un sitio donde puedas minimizar o eliminar las perturbaciones sonoras inesperadas.
Las reflexiones sonoras pueden producirse por la presencia de superficies duras y planas, lo que genera reverberación o ecos en tus grabaciones. Esto puede dar a tus Pistas un carácter hueco o distante, restando intimidad y claridad.
Prueba a aplaudir con fuerza en la sala y escucha con atención. Si percibes un sonido de aleteo o un eco prolongado, indica la presencia de problemas de reverberación.
Para solucionarlo, incorpora materiales Suaves que absorban el sonido. Considera usar alfombras, tapetes o cortinas gruesas para reducir notablemente las reflexiones. Cubrir los suelos duros y, si es posible, colgar cortinas sobre las ventanas, así como colocar muebles con fundas de tela en la sala, puede ser beneficioso.
Evita usar superficies duras, ya que contribuyen al problema. Si no puedes permitirte paneles acústicos profesionales, puedes usar elementos cotidianos como cuadros sobre Lienzo, tapices o paneles de espuma para romper estas superficies.
Al configurar tu micrófono, presta atención a su colocación. Evita situarlo demasiado cerca de las paredes o en las esquinas. En su lugar, apúntalo hacia el centro de la sala o experimenta con distintas ubicaciones para encontrar el punto óptimo con una reverberación mínima.
Fuga de auriculares
Durante las grabaciones, especialmente al capturar Voces, es común que el Audio de los auriculares se filtre en el micrófono. Este problema surge cuando el volumen de los auriculares está demasiado alto o cuando se usan auriculares de respaldo abierto. Esto puede ser aceptable al grabar una canción, pero procura evitar esta fuga al grabar para tu Modelo de Voz.
Colocación del micrófono
Para un volumen normal, se recomienda colocarte a unas 2 pulgadas del micrófono. Sin embargo, para frases más fuertes o al proyectar con potencia, conviene aumentar la distancia a unas 4-6 pulgadas. Es importante señalar que siempre debes permanecer a menos de 12 pulgadas del micrófono para mantener una captura de Audio óptima.
Crear espacio para el canto potente
Cuando uses técnicas de canto potente, es importante darte suficiente espacio, tanto en la distancia al micrófono como en el tamaño de la sala en la que te encuentres. Un aislamiento excesivo del sonido, como quedar encerrado en un armario o cabina, o rodear el micrófono con espuma, puede provocar fácilmente una sobrecarga de la cápsula del micrófono. Si no estás seguro, conviene incorporar más sonido de sala al interpretar frases potentes.
Idiomas de canto
Para una Voz del Cambiador de voz, no necesitas mantener todas las Muestras en un solo idioma.
Canto o discurso
Para una Voz del Cambiador de voz, no hay una gran diferencia entre Muestras de discurso y Muestras de canto. Pero para una Voz del Cambiador de voz para canto, es más adecuado usar Muestras de canto para el entrenamiento.
Configuración de calidad de archivos
La calidad de Audio de tus Muestras impacta directamente en la calidad de tu Voz.
Te recomendamos configurar tu calidad de Audio en:
Profundidad de bits = 16 bits
Frecuencia de muestreo = 44.1 kHz o 48 kHz
Formato de archivo sin pérdida (.wav o .flac)
Posprocesado
Para mantener el carácter natural y la claridad de tu Voz objetivo:
Sin solapamientos: las Voces multicapa pueden complicar el análisis de la IA. Coloca las tomas solapadas al fondo y mantén una sola Pista vocal para asegurarte de que la IA pueda procesar y aprender con precisión de tus Muestras.
Sin cortes bruscos: los cortes bruscos pueden crear inicios o finales repentinos, que no son normales en un sonido de canto natural, y pueden introducir clics o pops. Usa fundidos suaves al principio y al final del Clip vocal para lograr una transición más natural.
Sin secciones duplicadas: Las secciones duplicadas no ayudan al entrenamiento. Tu Modelo de Voz se beneficia de la variación natural de la interpretación.
Controla el volumen: Asegúrate de que tus Muestras se mantengan alrededor del 30-50% de tu medidor. Usa un control de volumen o Automatización para asegurarte de que los niveles de volumen sean consistentes en todo tu conjunto de datos. El objetivo es crear un nivel de volumen uniforme en toda la grabación, manteniendo la dinámica dentro de las secciones.
Entrenamiento de tu Voz
Después de preparar tus conjuntos de datos, puedes ir a Página de Voz personalizada para seleccionar una ranura personalizada, cargar tus Muestras e iniciar el entrenamiento.
Puedes personalizar una Voz del Cambiador de voz en una sola ranura personalizada.
Haz clic en una ranura para empezar a cargar tus Muestras.
Después de cargar todas las Muestras, el entrenamiento comenzará automáticamente. Puedes comprobar su estado actualizando la página web.
Cuando la página vuelva a la lista de ranuras con una nueva Voz entrenada, todo estará listo.
Haz clic en ‘Open in ACE’ para abrir ACE Studio y usar tu nueva Voz entrenada.
Reentrenamiento de tu Voz
Haz clic en el Reentrenar botón para reentrenar tu Voz.
El reentrenamiento eliminará tu Voz anterior en esta ranura. La IA empezará a entrenar una Voz completamente nueva desde cero usando el nuevo conjunto de datos. Antes de iniciar el proceso de reentrenamiento, puedes conservar las Muestras históricas de esta ranura y cargar Muestras nuevas adicionales, o bien puedes elegir borrar las Muestras históricas y usar solo las Muestras recién cargadas.
Al preparar nuevas Muestras, ten en cuenta:
Si la Duración: de las Muestras recién añadidas es significativamente menor que la de las Muestras ya cargadas, por ejemplo, añadir 1 min de nueva Muestra a un conjunto de datos de 30 min, el reentrenamiento puede no producir cambios significativos en el rendimiento.
El reentrenamiento no cambiará el tipo de tu ranura.
¿Cuándo debo reentrenar mi Voz?
Cuando tus conjuntos de datos tengan mejor calidad o una cantidad mayor que antes, puedes usarlos para mejorar tu Voz de forma iterativa
Cuando no estés satisfecho con el resultado actual y quieras ajustar tus conjuntos de datos
Gestionar tu Voz
Haz clic en el Gestionar botón para abrir la ventana de gestión de una Voz personalizada del Cambiador de voz. En esa ventana, puedes modificar:
Imagen de la Voz
Nombre de la Voz
Etiquetas
Tipo de Voz
Etiqueta de idioma (solo para el tipo de Voz)
Después de realizar cambios, puedes hacer clic en el Open in ACE botón para actualizar la lista de Voces de ACE Studio.
Última actualización