For the complete documentation index, see llms.txt. This page is also available as Markdown.

为声线转换克隆歌手声线

在 ACE Studio 中,将你自己的声线克隆为声线转换歌手。

什么是声线转换克隆?

此功能可让您通过上传自己的素材,自定义专属的声线转换声线。AI 将根据您上传的素材学习音色,并克隆出该声线的数字版本。

完成自定义后,您可以使用自己的配置文件,像在 ACE Studio 中使用我们预制的 AI 声线转换声线一样,从音频转换声线。

如何为声线转换克隆我的声线?

准备数据集

干声歌声

高质量声线需要干净的干声歌声素材:

  • 不含任何混响、延迟或合唱效果

  • 不含背景噪声

  • 不含伴奏或任何非人声声音

  • 不含任何和声或人声叠录

建议每个声线提供 30–100 分钟的演唱人声素材。您提供的素材越多,AI 能学习到的演唱细节就越丰富;但超过 120 分钟后,额外素材带来的收益会逐渐减少。

房间反射声

带有较强房间反射声录制的歌声可能导致识别错误,并造成模型表现不符合预期。

来自音轨分离的歌声

使用人声消除器或音轨分离获取歌声时,输出质量可能受损,低至无法用于训练。为获得更高质量的声线模型,请尽量使用音轨分离得到的歌声。

录制素材

高品质麦克风与音频接口

专业麦克风配合音频接口可录制高质量歌声。您还需要录音软件来连接接口,并录制、编辑和混音您的歌声。

为声线模型录音时,请避免使用并非为演唱设计的麦克风:

  • 手机或笔记本电脑麦克风

  • 领夹式或头戴式麦克风

  • KTV 麦克风

  • 耳机麦克风或 AirPods 等蓝牙耳机(通常用于手机通话)

录音环境

  1. 不需要的背景噪声可能包括交谈声、电流嗡声与杂音、交通及户外噪声,以及配件或物体移动产生的声音。为避免这些噪声干扰录音,选择安静的地点非常重要。请选择能够尽量减少或消除意外噪声干扰的场所。

  2. 硬质、平整的表面会造成声音反射,使录音产生混响或回声。这会令您的轨道听起来空洞或遥远,削弱所需的亲密感与清晰度。

  3. 尝试在房间内用力拍手并仔细聆听。如果听到颤动声或持续较长的回声,则表明存在混响问题。

  4. 为解决此问题,请加入可吸收声音的柔和材质。可考虑使用地毯、垫毯或厚窗帘,以显著减少反射声。覆盖硬质地面、尽可能在窗户上悬挂窗帘,并在房间中摆放带有布艺覆盖的家具,都会有所帮助。

  5. 避免使用硬质表面,因为它们会加剧问题。如果无力购买专业吸音板,可利用画布画作、挂毯或泡沫砖等日常物品来打散这些表面。

  6. 设置麦克风时,请注意其摆放位置。避免将其放得太靠近墙壁或置于角落。建议放在房间中央,或尝试不同位置,找出混响最少的最佳录音点。

耳机串音

录音时,特别是录制歌声时,耳机中的音频串入麦克风是很常见的情况。当耳机音量过高,或使用开放式耳机时,就可能出现此问题。这在歌曲录制中或许可以接受,但在为声线模型录音时应尽量避免这种串音。

麦克风摆位

以正常音量演唱时,建议与麦克风保持约 2 英寸的距离。但对于较响的乐句或强声演唱,建议将距离增加至约 4–6 英寸。请注意,为保持最佳音频拾取效果,您应始终与麦克风保持在 12 英寸以内。

为强声演唱预留空间

使用强声演唱技巧时,无论是与麦克风的距离,还是所在房间的大小,都应为自己预留充足空间。过度隔音,例如身处衣柜或录音棚隔间,或用泡沫材料包围麦克风,都很容易导致麦克风振膜过载。如不确定,演唱强声乐句时建议保留更多房间声。

演唱语言

对于声线转换声线,您无需将所有素材保持为同一种语言。

演唱或语音

对于声线转换声线,语音素材与演唱素材之间没有太大差异。但对于演唱型声线转换声线,使用演唱素材进行训练会更合适。

文件质量设置

素材的音频质量会直接影响您的声线质量。

建议将音频质量设置为:

  • 位深 = 16 位

  • 采样率 = 44.1 kHz 或 48 kHz

  • 无损文件格式(.wav 或 .flac)

后期处理

为保持目标声线的自然特质与清晰度:

  • 不要重叠: 多层人声会增加 AI 分析的复杂度。请将重叠的录音置于后方,并坚持使用单一人声轨道,以确保 AI 能够准确处理并从您的素材中学习。

  • 不要硬切: 硬切会造成突兀的起始或结束,这不符合自然演唱的声音特征,也可能引入咔嗒声或爆音。请在人声片段的开头和结尾使用平滑淡化,以获得更自然的过渡。

  • 不要重复片段: 重复的片段无助于训练。声线模型将受益于演唱表现中的自然变化。

  • 控制音量: 请确保素材音量维持在电平表约 30–50% 的范围内。使用音量骑乘或自动化,确保整个数据集的音量电平保持一致。目标是在整段录音中建立稳定的音量电平,同时保留各片段内部的动态变化。

训练您的声线

准备好数据集后,您可以前往 自定义声线页面 选择一个自定义槽位,上传素材并开始训练。

您可以在一个自定义槽位中自定义一个声线转换声线。

点击槽位即可开始上传素材。

所有素材上传完成后,训练将自动开始。您可以刷新网页查看其状态。

当页面跳回槽位列表并显示新训练的声线时,即表示一切就绪。

点击“在 ACE 中打开”,即可打开 ACE Studio 并使用您新训练的声线。

重新训练您的声线

点击 重新训练 按钮以重新训练您的声线。

重新训练会移除此槽位下原有的声线。AI 将使用新数据集从头开始训练一个全新的声线。在开始重新训练前,您可以选择保留该槽位中的历史素材并上传额外的新素材,或者清除历史素材,仅使用新上传的素材。

准备新素材时,请注意:

  • 如果新增素材的时长远小于已上传素材,例如向 30 分钟的数据集中仅添加 1 分钟的新素材,重新训练可能不会显著改变表现。

  • 重新训练不会改变槽位的类型。

何时应重新训练我的声线?

  • 当您的数据集质量更高或数量更多时,可使用它们迭代改进您的声线。

  • 当您对当前结果不满意,并希望调整数据集时

管理您的声线

点击 管理 按钮以打开自定义声线转换声线的管理窗口。您可以在该窗口中修改:

  • 歌手图片

  • 歌手名称

  • 标签

  • 歌手类型

  • 语言标签(仅适用于歌手类型)

完成更改后,您可以点击 在 ACE 中打开 按钮,以刷新 ACE Studio 的声线列表。

最后更新于