> For the complete documentation index, see [llms.txt](https://docs.acestudio.ai/llms.txt). Markdown versions of documentation pages are available by appending `.md` to page URLs; this page is available as [Markdown](https://docs.acestudio.ai/docs/product-wiki-zh/sheng-yin-ke-long/cloning-a-voice-for-voice-changer.md).

# 用于声线转换的声音克隆

## 什么是声线转换克隆？

这是一个通过上传素材来自定义属于你的声线转换歌手的功能。AI 会根据你上传的素材学习音色，并克隆出这个歌手的数字版本。

定制完成后，你就可以像使用 ACE Studio 中预设的 AI 声线转换歌手一样，使用你的个人档案对音频中的歌手进行转换。

{% hint style="success" %}
你克隆出的 AI 歌手仅在你的账户下私有，未经你的授权，其他人无法访问。
{% endhint %}

## 如何为声线转换克隆我的歌手？

### 准备你的数据集

<details>

<summary>干净的干声</summary>

高质量的声线需要干净、干燥的歌声素材：

* 不含任何混响、延迟、合唱效果
* 不含背景噪声
* 不含伴奏或任何非人声
* 不含任何和声或叠唱

建议为一个歌手准备 30-100 分钟的歌声素材。你提供的素材越多，AI 能学习到的演唱细节就越多，但当时长超过 120 分钟后，收益会越来越小。

> 房间反射
>
> 在大空间反射环境中录制的歌声，可能会导致识别错误，并使模型表现不如预期。

> 来自音轨分离的歌声
>
> 当你使用人声消除器或音轨分离处理歌声时，输出质量可能会受损，低到不足以用于训练。若想获得更高质量的歌手模型，请尽量使用来自音轨分离的歌声。

</details>

<details>

<summary>录制素材</summary>

**搭配音频接口的高质量麦克风**

专业麦克风搭配音频接口能够带来高质量的歌声。你需要录音软件来连接接口，录制、编辑并混音你的歌声。

录制歌手模型时，请避免使用并非为演唱而设计的麦克风：

* 手机或笔记本电脑麦克风
* 领夹麦克风或头戴式麦克风
* 卡拉 OK 麦克风
* 耳机麦克风或蓝牙耳机，如 AirPods（这些通常用于通话）

**录音环境**

1. 不需要的背景噪声包括人们说话声、电流嗡鸣和嘶嘶声、交通与户外噪声，以及配件或物体移动的声音。为了防止这些噪声干扰录音，选择一个安静的地点非常重要。请选一个可以尽量减少或消除意外噪声干扰的地方。
2. 由于硬质、平整表面的存在，声音反射可能会出现，从而在录音中产生混响或回声。这会让你的轨道听起来空洞、遥远，削弱所需的亲密感与清晰度。
3. 试着在房间里用力拍手，并仔细聆听。如果你听到颤动声或拖长的回声，就说明存在混响问题。
4. 为了解决这个问题，请加入能够吸音的柔软材料。可以考虑使用地毯、地垫或厚窗帘来显著减少反射。覆盖硬质地板，如有可能，在窗户上挂上窗帘，并在房间里摆放带布艺包覆的家具，也会有所帮助。
5. 避免使用硬质表面，因为它们会加剧这个问题。如果你负担不起专业吸音板，也可以利用画布装饰画、挂毯或泡沫板砖等日常物品来打散这些表面。
6. 设置麦克风时，请注意摆放位置。避免将其放得离墙面太近或置于角落。相反，尽量放在房间中央，或尝试不同位置，找到混响最小的最佳点。

**耳机漏音**

在录音过程中，尤其是在录制歌声时，耳机中的声音泄漏到麦克风里很常见。这个问题通常发生在耳机音量过高，或使用开放式耳机时。录歌时这也许还能接受，但在为你的歌手模型录音时，尽量避免这种漏音。

**麦克风摆位**

在常规音量下，建议你与麦克风保持约 2 英寸的距离。不过，在较大音量的乐句或使用强声演唱时，建议将距离增加到约 4-6 英寸。需要注意的是，为了保持最佳收音效果，你始终应与麦克风保持在 12 英寸以内。

> 为强声演唱留出空间
>
> 在进行强声演唱时，务必要为自己留出足够空间，包括麦克风距离和所处房间的大小。过度隔音，例如把自己困在衣柜或隔音间里，或者用泡沫把麦克风包围起来，都很容易导致麦克风振膜过载。如果你不确定，演唱强声乐句时最好保留更多房间声。

</details>

<details>

<summary>演唱语言</summary>

对于声线转换歌手，你不需要让所有素材都保持同一种语言。

</details>

<details>

<summary>演唱或说话</summary>

对于声线转换歌手来说，说话素材和演唱素材之间没有太大区别。不过对于用于演唱的声线转换歌手，使用演唱素材进行训练会更合适。

</details>

<details>

<summary>文件质量设置</summary>

你的素材音频质量会直接影响你的歌手模型质量。

我们建议你将音频质量设置为：

* 位深 = 16-bit
* 采样率 = 44.1 kHz 或 48 kHz
* 无损文件格式（.wav 或 .flac）

</details>

<details>

<summary>后期处理</summary>

为保持目标歌手的自然特性与清晰度：

* **不要重叠：** 多层叠加的歌声会让 AI 的分析变得复杂。请将重叠的录音段放在后面，并坚持使用单一的人声轨道，以确保 AI 能够准确处理并从你的素材中学习。
* **不要硬切：** 硬切会造成突兀的起止，这在自然演唱中并不常见，还可能引入咔嗒声或爆音。请在人声片段的开头和结尾使用平滑淡入淡出，以获得更自然的过渡。
* **不要重复片段：** 重复的片段对训练没有帮助。你的歌手模型更能从表演中的自然变化中受益。
* **控制音量：** 请确保你的素材保持在电平表 30-50% 左右。使用音量推子或自动化，确保整个数据集中的音量保持一致。目标是在录音中建立统一的音量水平，同时保留各段内部的动态变化。

</details>

### 训练你的歌手

准备好数据集后，你可以前往 <a href="https://acestudio.ai/app/custom-voice/voice-changer" class="button secondary" data-icon="browser">自定义歌手页面</a> 选择一个自定义槽位，上传你的素材并开始训练。

你可以在一个自定义槽位中定制一个声线转换歌手。

点击某个槽位即可开始上传你的素材。

所有素材上传完成后，训练将自动开始。你可以通过刷新网页查看其状态。

当页面跳回槽位列表并显示新的已训练歌手时，就全部完成了。

点击“Open in ACE”打开 ACE Studio，并使用你新训练的歌手。

### 重新训练你的歌手

点击 <kbd>重新训练</kbd> 按钮可重新训练你的歌手。

重新训练将移除该槽位下你之前的歌手。AI 会使用新的数据集从零开始训练一个全新的歌手。在开始重新训练之前，你可以选择保留该槽位中的历史素材并继续上传新的素材，或者清空历史素材，仅使用新上传的素材。

准备新素材时，请注意：

* 如果新添加素材的时长明显少于已上传素材，例如在 30 分钟的数据集中只添加 1 分钟的新素材，重新训练可能不会在表现上带来明显变化。
* 重新训练不会改变你的槽位类型。

{% hint style="info" %}
**我什么时候应该重新训练我的歌手？**

* 当你的数据集比之前质量更高或数量更多时，你可以用它们迭代优化你的歌手模型
* 当你对当前结果不满意，并希望调整数据集时
  {% endhint %}

### 管理你的歌手

点击 <kbd>管理</kbd> 按钮可打开自定义声线转换歌手的管理窗口。在该窗口中，你可以修改：

* 歌手头像
* 歌手名称
* 标签
* 歌手类型
* 语言标签（仅适用于该歌手类型）

完成修改后，你可以点击 <kbd>在 ACE 中打开</kbd> 按钮来刷新 ACE Studio 的歌手列表。


---

# Agent Instructions
This documentation is published with GitBook. GitBook is the documentation platform designed so that both humans and AI agents can read, navigate, and reason over technical content effectively. Learn more at gitbook.com.

## Querying This Documentation
If you need additional information that is not directly available in this page, you can query the documentation dynamically by asking a question.

Perform an HTTP GET request on the current page URL with the `ask` query parameter, and the optional `goal` query parameter:

```
GET https://docs.acestudio.ai/docs/product-wiki-zh/sheng-yin-ke-long/cloning-a-voice-for-voice-changer.md?ask=<question>&goal=<endgoal>
```

`ask` is the immediate question: it should be specific, self-contained, and written in natural language.
`goal` is optional and describes the broader end goal you are ultimately trying to accomplish on behalf of the user. GitBook uses it to tailor the answer towards what is most useful for that goal.

The response will contain a direct answer to the question and relevant excerpts and sources from the documentation.

Use this mechanism when the answer is not explicitly present in the current page, you need clarification or additional context, or you want to retrieve related documentation sections.
