RVC WebUI 的 UVR5 人声伴奏分离终极指南:免费开源 AI 音频分离,翻唱伴奏一次提取到位

RVC WebUI 的 UVR5 人声伴奏分离终极指南:免费开源 AI 音频分离,翻唱伴奏一次提取到位 RVC WebUI 的 UVR5 人声伴奏分离终极指南免费开源 AI 音频分离翻唱伴奏一次提取到位【免费下载链接】Retrieval-based-Voice-Conversion-WebUIEasily train a good VC model with voice data 10 mins!项目地址: https://gitcode.com/GitHub_Trending/re/Retrieval-based-Voice-Conversion-WebUI读完这篇指南你会用 RVC WebUI 内置的 UVR5 模块把一个音频文件夹批量完成人声伴奏分离得到人声和非人声两份干净结果。整套流程基于免费开源 AI 音频分离工具不依赖任何付费软件环境配好后每次使用只是填个路径、提交一次转换。下面按环境准备、首跑流程、参数详解、问题排查、延伸用法五个部分展开。UVR5 环境准备克隆代码、装依赖、下模型准备线一共四步按顺序做完就能启动界面。第一步克隆代码git clone https://gitcode.com/GitHub_Trending/re/Retrieval-based-Voice-Conversion-WebUI第二步按显卡选依赖文件安装装错显卡对应的依赖是后续环境类报错的主要来源显卡安装命令NVIDIApip install -r requirements.txtAMDpip install -r requirements-amd.txtIntelpip install -r requirements-ipex.txt第三步下载模型权重Windows 运行tools/dlmodels.batLinux/Mac 运行tools/dlmodels.shUVR5 的权重会被存进assets/uvr5_weights/目录。第四步启动界面Windows 双击go-web.batLinux/Mac 执行bash run.sh浏览器会自动打开主界面。如果模型下拉框是空的不要硬跑跳到「UVR5 分离结果不对时的四步排查清单」一节处理。第一次人声伴奏分离怎么走填文件夹、选模型、跑转换第一次走通流程只需要五个动作打开界面顶部的「伴奏人声分离去混响去回声」标签页所有字段都在这一屏里。填入「输入待处理音频文件夹路径」指向放待处理音频的目录。也可以直接勾选多个文件但填了文件夹时以文件夹为准。在模型下拉框选一个模型首跑建议选 HP3主人声保留更完整适合大多数歌曲。其余字段保持默认聚合度 10导出格式 flac主人声 / 非主人声输出目录落在默认的opt下两个子目录。点「转换」。右侧「输出信息」会逐行打出文件名 → 成功全部出现即完成。采样率不用手动处理源码逻辑会先用 ffprobe 检查只要源文件不是 44100Hz 双声道程序就用 ffmpeg 自动重采样成 44100Hz 双声道再分离见 tools/uvr5/。你只需要避免拿低码率、过度压缩的文件当源文件。跑完先确认两件事opt下两个子目录里的文件数量和输入对得上「输出信息」里没有失败字样。听感层面的验收放到排查一章一起说。UVR5 参数怎么调模型对照表、聚合度与导出格式先对齐预期分离是算法抠出来的结果伴奏里留一丝人声、人声里漏一点伴奏属于正常水平不是装坏了。处理是批量式的不是实时分离得等整段文件跑完另外 MDX-Netonnx_dereverb_By_FoxJoy只处理双通道混响单通道混响交给 DeEcho 系列但单通道混响也无法保证完全除干净。模型对照表先选对模型其余参数才有意义模型适用场景注意点HP2没有和声的歌曲保留主人声整体最均衡通用首选HP3没有和声的歌曲主人声保留更完整可能轻微漏进伴奏HP5带和声的歌曲只保留主旋律人声主人声可能略被削弱onnx_dereverb_By_FoxJoy去除双通道混响仅支持双通道录音DeEcho-Normal去延迟、去单声道混响处理力度温和DeEcho-Aggressive去延迟、去单声道混响更彻底残留清理更激进DeEcho-DeReverb在去延迟基础上去混响耗时接近 2 倍聚合度界面里叫人声提取激进程度默认 10可调范围 0-20。它决定抠人声的力度——数值越高人声留得越干净但被一并带走的伴奏频率也越多数值越低人声越原声但残留越明显。首跑用默认值即可后续按听感微调。导出文件格式支持 flac、wav、mp3、m4a 四种默认 flac。后面还要进剪辑软件加工选 flac 或 wav只存档或分享选 mp3 更省空间。输出目录「指定输出主人声文件夹」「指定输出非主人声文件夹」保持默认opt即可两个子目录各收一路结果别把它们指到同一个目录里。UVR5 分离结果不对时的四步排查清单先明确合格标准再按顺序查问题到主人声文件夹听——人声是否完整、有没有伴奏漏进来到非主人声文件夹听——歌词是否已经听不出来。两边都过关这次分离才算合格。不合格时按「模型 → 参数 → 源文件 → 环境」的顺序查前三步就能定位大多数问题模型选对了吗有和声的歌用了 HP2/HP3和声会被当主人声一起保留想去混响却选了 HP5等于白跑。对照上面的模型表换一个再跑一遍。聚合度合适吗伴奏里人声残留多把聚合度从 10 提到 12-15人声变薄、伴奏味太重往 8 降。每次只动 2 档听完再决定下一步。源文件撑得住吗单声道、低码率 MP3、本身就有严重削波的文件分离上限就在那儿——模型只能把已有信息分开补不出缺失的信息。换一份无损源文件再试。依赖环境全吗看「输出信息」里有没有报错堆栈模型下拉框选不到、或提示找不到权重检查assets/uvr5_weights/目录下有没有以.pth结尾的权重文件torch 版本与显卡不匹配AMD 用户装错 requirements 文件最常见就重新按第二步安装。各报错的详细解释见 docs/cn/faq.md 及 docs/ 下其他语言版本。模型下载失败的处理确认assets/uvr5_weights/里没有.pth权重就重新跑一次tools/dlmodels.bat或.sh仍不行的话按项目文档里的下载链接手动把权重放进该目录重启界面后下拉框里就能选到了。UVR5 人声伴奏分离的三个延伸用法做翻唱用 HP3 把伴奏抠出来再录自己的声轨最后在剪辑软件里把两轨叠到同一条时间轴上对齐进拍点即可。清理播客房间回声先用 onnx_dereverb_By_FoxJoy 去掉双通道房间回声残留没清干净的再补一遍 DeEcho-Aggressive。两个模型接力比单跑一个模型更干净是双通道录音推荐的处理顺序。视频重新配音先把视频音轨导出成音频用 UVR5 把背景音乐和原声分成两路背景音乐轨留作垫底人声轨替换成你的配音再按段落拉平音量。收尾行动清单让分离结果真正用起来挑一首干净的立体声歌曲用 HP3 完整跑一遍两个输出文件夹各听一遍。记下人声残留和伴奏漏音最严重的时间点再用聚合度 12 和 8 各跑一次做 A/B 对比。去混响场景按 MDX-Net → DeEcho-Aggressive 的顺序对双通道录音试一遍。分离稳定之后把提出来的干净人声直接接到 RVC 主界面走后续的变声流程。assets/uvr5_weights/里有一组权重、手里有一个立体声音频文件UVR5 的人声伴奏分离就只剩填路径、提交转换这一件事了。【免费下载链接】Retrieval-based-Voice-Conversion-WebUIEasily train a good VC model with voice data 10 mins!项目地址: https://gitcode.com/GitHub_Trending/re/Retrieval-based-Voice-Conversion-WebUI创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考