ARTICLE · 1074554
来了来了,终于找到靠谱的ai翻唱工具了
来了来了,终于找到靠谱的ai翻唱工具了RVC(Retrieval-based Voice Conversion)是一款开源的AI语音转换工具,可以把你已有的声音"换皮"成另一个音色,同时保留原来说话的语气、节奏和情绪。 

这是RVC最火的应用场景。流程大致分四步: 
直播、游戏开黑、语音聊天时实时变声,这个玩法最近也很火。 /~21203b4eUM~:/ 链接:https://pan.quark.cn/s/afd9da9cb5ad
文章结尾附带链接🔗

它主要有两大玩法:AI翻唱和实时变声。

🎤 AI翻唱
准备干声素材:收集10-30分钟目标音色的纯净人声(无BGM、无混响),切成10-30秒一段。素材越干净,最终效果越好。 训练模型:用RVC的WebUI界面加载干声素材,一键训练。训练轮数建议50-200轮,太多容易过拟合,出来的声音反而发颤、电音重。 分离歌曲人声:用RVC内置的 UVR5 工具把想翻唱的歌曲分离成"人声干声"和"伴奏"两部分。 推理转换 + 合成:加载训练好的模型,把歌曲的干声做音色转换,最后用 Audacity 或 AU 把新干声和伴奏合轨导出。

🎙️ 实时变声
需要额外安装一个虚拟声卡( VoiceMeeter ),让麦克风的声音先进入RVC处理,再通过虚拟声卡输出到QQ、游戏或其他软件。 社区有现成的RVC变声整合包,内置57个音色模型,解压即用,不用自己训练。 音调设置:男变女大约+12,女变男大约-12,同性别之间设为0。
⚡ 新手最容易踩的坑
解压路径不能有中文:这是90%的人第一步就报错的原因,文件夹名、文件名全部用英文或数字。 音高提取算法选 rmvpe:对哑音处理更稳,速度也快,比crepe省资源。 一定要加载.index文件:模型配套的.index文件能明显提升音色相似度,不加载会浪费模型的检索能力。 索引率(Index Rate)调0.7-0.8:太低不像,太高失真,这个区间大部分人声效果最自然。 显卡要求:变声推理3G显存的老显卡就能跑,但训练模型需要英伟达显卡、6G显存以上,Mac和手机都不支持本地训练。没有合适显卡可以租云服务器。
我用夸克网盘给你分享了「【AI唱歌软件】...超厉害】」,点击链接或复制整段内容,打开「夸克APP」即可获取。