AI声音克隆怎么做?需要多少素材、几步能出效果
声音克隆的门槛比想象中低。本文说明需要准备多少素材、完整的克隆步骤、二次验证是什么,以及克隆后怎么用来生成歌曲。
声音克隆听起来像很高级的技术,实际动手的门槛比想象中低:一段几十秒的清晰人声,加上一次身份验证,就能得到一个可以用于生成歌曲的专属音色。
需要准备多少素材
| 素材 | 要求 |
|---|---|
| 时长 | 几十秒到几分钟都可用,越长越稳 |
| 内容 | 自然说话的语音,或者清唱 |
| 质量 | 安静环境、无背景音乐、无混响 |
| 格式 | 常见音频格式即可,文件控制在 10MB 以内 |
不是越长越好。三段各三十秒的干净录音,效果通常好于一段三分钟但带背景噪音的录音。
完整流程
- 准备录音:安静环境,用手机自带录音即可,避免开美声或降噪过度处理。
- 提交克隆:上传素材,系统开始建立音色。
- 完成二次验证:这一步是为了确认声音是本人。按提示说几句话完成验证即可。
- 获得音色:验证通过后,这个音色就能用于后续生成。
- 生成歌曲:在生成时选择已克隆的音色,输入歌词和风格,产出的歌曲会用这个嗓音演唱。
二次验证是什么,为什么必须有
声音属于个人生物特征信息,平台必须确认操作者是本人,否则任何人都能克隆别人的声音。二次验证就是为此设置的门槛:系统会要求你现场说几句话,确认真人并且验证声音特征一致。
如果觉得手动流程麻烦,也可以使用自动协助验证的方式,5 元一次。手动验证本身免费。
提高克隆效果的四条经验
- 录音时不要刻意改变语调:用平时说话的语速和音调,克隆出来才像你。
- 避免背景音乐:哪怕音量很小,也会被当成音色的一部分学进去。
- 内容多样化:念一段数字、一段日常对话、一段有起伏的句子,比反复念同一句话效果好。
- 不要做重度后期:降噪和美声会削掉声音的个人特征,反而不像本人。
克隆之后能做什么
- 用自己(或已获授权的人)的嗓音生成原创歌曲。
- 给自己的原创歌词配上自己的声音。
- 做多语种版本:同一首歌用同一个音色唱不同语言。
费用和边界
手动人声校验及普通克隆免费,使用已克隆人声生成歌曲 1.20 元一次,自动协助二次验证 5 元一次。完整的音色创建与使用说明见声音克隆。
最后必须说清楚:克隆他人声音需要获得本人明确授权。未经许可克隆并使用他人声音,既涉及侵权也可能违反平台规则,平台不为此提供任何授权。自己的声音、或者已经拿到书面同意的声音,才是安全的范围。