> For the complete documentation index, see [llms.txt](https://docs.acestudio.ai/llms.txt). Markdown versions of documentation pages are available by appending `.md` to page URLs; this page is available as [Markdown](https://docs.acestudio.ai/docs/product-wiki-zh/sheng-yin-ke-long/cloning-a-voice-for-voice-changer.md).

# 为声线转换克隆声线

## 什么是声线转换克隆？

此功能可让您通过上传自己的素材，自定义专属的声线转换声线。AI 将根据您上传的素材学习音色，并克隆出该声线的数字版本。

完成自定义后，您可以使用自己的配置文件，像在 ACE Studio 中使用我们预制的 AI 声线转换声线一样，从音频转换声线。

{% hint style="success" %}
您克隆的 AI 声线仅限您的账户私有使用，未经您的授权，任何人都无法访问。
{% endhint %}

## 如何为声线转换克隆我的声线？

### 准备数据集

<details>

<summary>干声歌声</summary>

高质量声线需要干净的干声歌声素材：

* 不含任何混响、延迟或合唱效果
* 不含背景噪声
* 不含伴奏或任何非人声声音
* 不含任何和声或人声叠录

建议每个声线提供 30–100 分钟的演唱人声素材。您提供的素材越多，AI 能学习到的演唱细节就越丰富；但超过 120 分钟后，额外素材带来的收益会逐渐减少。

> 房间反射声
>
> 带有较强房间反射声录制的歌声可能导致识别错误，并造成模型表现不符合预期。

> 来自音轨分离的歌声
>
> 使用人声消除器或音轨分离获取歌声时，输出质量可能受损，低至无法用于训练。为获得更高质量的声线模型，请尽量使用音轨分离得到的歌声。

</details>

<details>

<summary>录制素材</summary>

**高品质麦克风与音频接口**

专业麦克风配合音频接口可录制高质量歌声。您还需要录音软件来连接接口，并录制、编辑和混音您的歌声。

为声线模型录音时，请避免使用并非为演唱设计的麦克风：

* 手机或笔记本电脑麦克风
* 领夹式或头戴式麦克风
* KTV 麦克风
* 耳机麦克风或 AirPods 等蓝牙耳机（通常用于手机通话）

**录音环境**

1. 不需要的背景噪声可能包括交谈声、电流嗡声与杂音、交通及户外噪声，以及配件或物体移动产生的声音。为避免这些噪声干扰录音，选择安静的地点非常重要。请选择能够尽量减少或消除意外噪声干扰的场所。
2. 硬质、平整的表面会造成声音反射，使录音产生混响或回声。这会令您的轨道听起来空洞或遥远，削弱所需的亲密感与清晰度。
3. 尝试在房间内用力拍手并仔细聆听。如果听到颤动声或持续较长的回声，则表明存在混响问题。
4. 为解决此问题，请加入可吸收声音的柔和材质。可考虑使用地毯、垫毯或厚窗帘，以显著减少反射声。覆盖硬质地面、尽可能在窗户上悬挂窗帘，并在房间中摆放带有布艺覆盖的家具，都会有所帮助。
5. 避免使用硬质表面，因为它们会加剧问题。如果无力购买专业吸音板，可利用画布画作、挂毯或泡沫砖等日常物品来打散这些表面。
6. 设置麦克风时，请注意其摆放位置。避免将其放得太靠近墙壁或置于角落。建议放在房间中央，或尝试不同位置，找出混响最少的最佳录音点。

**耳机串音**

录音时，特别是录制歌声时，耳机中的音频串入麦克风是很常见的情况。当耳机音量过高，或使用开放式耳机时，就可能出现此问题。这在歌曲录制中或许可以接受，但在为声线模型录音时应尽量避免这种串音。

**麦克风摆位**

以正常音量演唱时，建议与麦克风保持约 2 英寸的距离。但对于较响的乐句或强声演唱，建议将距离增加至约 4–6 英寸。请注意，为保持最佳音频拾取效果，您应始终与麦克风保持在 12 英寸以内。

> 为强声演唱预留空间
>
> 使用强声演唱技巧时，无论是与麦克风的距离，还是所在房间的大小，都应为自己预留充足空间。过度隔音，例如身处衣柜或录音棚隔间，或用泡沫材料包围麦克风，都很容易导致麦克风振膜过载。如不确定，演唱强声乐句时建议保留更多房间声。

</details>

<details>

<summary>演唱语言</summary>

对于声线转换声线，您无需将所有素材保持为同一种语言。

</details>

<details>

<summary>演唱或语音</summary>

对于声线转换声线，语音素材与演唱素材之间没有太大差异。但对于演唱型声线转换声线，使用演唱素材进行训练会更合适。

</details>

<details>

<summary>文件质量设置</summary>

素材的音频质量会直接影响您的声线质量。

建议将音频质量设置为：

* 位深 = 16 位
* 采样率 = 44.1 kHz 或 48 kHz
* 无损文件格式（.wav 或 .flac）

</details>

<details>

<summary>后期处理</summary>

为保持目标声线的自然特质与清晰度：

* **不要重叠：** 多层人声会增加 AI 分析的复杂度。请将重叠的录音置于后方，并坚持使用单一人声轨道，以确保 AI 能够准确处理并从您的素材中学习。
* **不要硬切：** 硬切会造成突兀的起始或结束，这不符合自然演唱的声音特征，也可能引入咔嗒声或爆音。请在人声片段的开头和结尾使用平滑淡化，以获得更自然的过渡。
* **不要重复片段：** 重复的片段无助于训练。声线模型将受益于演唱表现中的自然变化。
* **控制音量：** 请确保素材音量维持在电平表约 30–50% 的范围内。使用音量骑乘或自动化，确保整个数据集的音量电平保持一致。目标是在整段录音中建立稳定的音量电平，同时保留各片段内部的动态变化。

</details>

### 训练您的声线

准备好数据集后，您可以前往 <a href="https://acestudio.ai/app/custom-voice/voice-changer" class="button secondary" data-icon="browser">自定义声线页面</a> 选择一个自定义槽位，上传素材并开始训练。

您可以在一个自定义槽位中自定义一个声线转换声线。

点击槽位即可开始上传素材。

所有素材上传完成后，训练将自动开始。您可以刷新网页查看其状态。

当页面跳回槽位列表并显示新训练的声线时，即表示一切就绪。

点击“在 ACE 中打开”，即可打开 ACE Studio 并使用您新训练的声线。

### 重新训练您的声线

点击 <kbd>重新训练</kbd> 按钮以重新训练您的声线。

重新训练会移除此槽位下原有的声线。AI 将使用新数据集从头开始训练一个全新的声线。在开始重新训练前，您可以选择保留该槽位中的历史素材并上传额外的新素材，或者清除历史素材，仅使用新上传的素材。

准备新素材时，请注意：

* 如果新增素材的时长远小于已上传素材，例如向 30 分钟的数据集中仅添加 1 分钟的新素材，重新训练可能不会显著改变表现。
* 重新训练不会改变槽位的类型。

{% hint style="info" %}
**何时应重新训练我的声线？**

* 当您的数据集质量更高或数量更多时，可使用它们迭代改进您的声线。
* 当您对当前结果不满意，并希望调整数据集时
  {% endhint %}

### 管理您的声线

点击 <kbd>管理</kbd> 按钮以打开自定义声线转换声线的管理窗口。您可以在该窗口中修改：

* 歌手图片
* 歌手名称
* 标签
* 歌手类型
* 语言标签（仅适用于歌手类型）

完成更改后，您可以点击 <kbd>在 ACE 中打开</kbd> 按钮，以刷新 ACE Studio 的声线列表。


---

# Agent Instructions
This documentation is published with GitBook. GitBook is the documentation platform designed so that both humans and AI agents can read, navigate, and reason over technical content effectively. Learn more at gitbook.com.

## Querying This Documentation
If you need additional information that is not directly available in this page, you can query the documentation dynamically by asking a question.

Perform an HTTP GET request on the current page URL with the `ask` query parameter, and the optional `goal` query parameter:

```
GET https://docs.acestudio.ai/docs/product-wiki-zh/sheng-yin-ke-long/cloning-a-voice-for-voice-changer.md?ask=<question>&goal=<endgoal>
```

`ask` is the immediate question: it should be specific, self-contained, and written in natural language.
`goal` is optional and describes the broader end goal you are ultimately trying to accomplish on behalf of the user. GitBook uses it to tailor the answer towards what is most useful for that goal.

The response will contain a direct answer to the question and relevant excerpts and sources from the documentation.

Use this mechanism when the answer is not explicitly present in the current page, you need clarification or additional context, or you want to retrieve related documentation sections.
