新闻详情

新闻详情

首页 / 资讯中心 / 详情

RVC WebUI UVR5 人声提取新手教程:一条时间线走通免费人声伴奏分离,伴奏直接拿去翻唱

发布时间:2026/9/19 8:02:37来源:尧图网络
RVC WebUI UVR5 人声提取新手教程:一条时间线走通免费人声伴奏分离,伴奏直接拿去翻唱
RVC WebUI UVR5 人声提取新手教程一条时间线走通免费人声伴奏分离伴奏直接拿去翻唱【免费下载链接】Retrieval-based-Voice-Conversion-WebUIEasily train a good VC model with voice data 10 mins!项目地址: https://gitcode.com/GitHub_Trending/re/Retrieval-based-Voice-Conversion-WebUIRVC WebUIRetrieval-based-Voice-Conversion-WebUI内置的 UVR5 人声提取功能专门做一件事把你手里的立体声音频做人声伴奏分离。跑完之后你会在输出目录里拿到两个文件夹——主人声和非主人声主人声是抠出来的人声轨非主人声就是你要的干净伴奏。直接拿去做翻唱、给视频配音、清理录音里的房间回声都不需要再经过任何中间工具。 能力与边界先把预期摆正能对整个文件夹批量分离导出 flac / wav / mp3 / m4a 四种格式能去混响、去延迟。MDX-Net 模型onnx_dereverb_By_FoxJoy处理双通道混响DeEcho 系列处理回声和单声道混响不能实时分离每个文件必须等整段处理完不能把单通道混响彻底除干净MDX-Net 只支持双通道心理预期分离是抠出来的伴奏里残留一丝人声、人声里漏进一点伴奏是这类算法的正常水平不是环境没装对⏱️ 从装好到出结果一条时间线走完按顺序做全程大约就是装代码 → 装依赖 → 拉权重 → 起界面 → 填参数 → 点转换 → 验收一条线中途不用切换文档。① 拿代码git clone https://gitcode.com/GitHub_Trending/re/Retrieval-based-Voice-Conversion-WebUI② 按显卡装依赖依赖文件按你的显卡选装错显卡是最常见的翻车点显卡安装命令NVIDIApip install -r requirements.txtAMDpip install -r requirements-amd.txtIntelpip install -r requirements-ipex.txt③ 拉 UVR5 权重运行tools/dlmodels.batWindows或tools/dlmodels.shLinux/Mac脚本会把全部 UVR5 权重下载进assets/uvr5_weights/目录。这一步是后面模型下拉框里能选到东西的前提如果失败或列表为空见文末「权重缺失怎么补」。④ 启动界面Windows 双击项目根目录的go-webui.batLinux/Mac 执行python webui.py浏览器会自动打开主界面首次启动耐心等几十秒。⑤ 切到分离页签点顶部的「伴奏人声分离去混响去回声」标签所有字段都在这一屏。⑥ 填参数模型按你的目标选选型表见下节翻唱抽伴奏选 HP3 最稳输入待处理音频文件夹路径填音频所在目录整个文件夹会批量处理也可以改用旁边的多选文件框但填了文件夹时文件夹优先人声提取激进程度聚合度默认 10 先用着残多残少再微调0-20越大抠得越狠导出文件格式默认 flac 无损。后期还要加工就选 flac 或 wav只是存档分享选 mp3 更省空间指定输出主人声 / 非主人声文件夹保持默认opt即可结果会分别落进两个子目录名字可以改但别改成不存在的深层路径采样率不用你操心源码逻辑会先用 ffprobe 检测只要源文件不是 44100Hz 双声道程序自动用 ffmpeg 重编码成 44100Hz 双声道再处理。唯一要你自己把关的是——别拿过度压缩的低码率 MP3 当源文件模型只能分开已有的信息补不了没有的信息。⑦ 点「转换」右侧「输出信息」会逐行打出文件名 → 成功全部打完整批完成。⑧ 验收到主人声文件夹听人声是否完整、有没有伴奏漏进来到非主人声文件夹听歌词是否已经基本听不出来两边都过关这次分离才算合格伴奏直接就能进剪辑软件铺底。️ 参数速查模型怎么选、字段怎么填UVR5 模型选型表模型适用场景HP2没有和声的歌曲保留主人声整体最均衡HP3同 HP2主人声保留更完整可能轻微漏一点伴奏HP5带和声的歌曲只留主旋律人声主人声可能被略削弱onnx_dereverb_By_FoxJoy去双通道混响MDX-NetDeEcho-Normal去延迟、去混响标准档DeEcho-Aggressive同 Normal 但更彻底DeEcho-DeReverb额外去混响耗时接近前两者的 2 倍字段填写表字段填法为什么这么填输入待处理音频文件夹路径待处理音频目录或改用多选文件框文件夹优先级更高适合批量模型先翻唱选 HP3去混响选 onnx_dereverb_By_FoxJoy模型选错后面参数全白填人声提取激进程度默认 10残多往 12-15 调人声变薄往 8 调越大抠得越狠但伴奏里被带走的频率也越多导出文件格式flac默认无损后续加工不二次损失输出主人声 / 非主人声文件夹默认opt结果分两个子目录落盘互不覆盖 结果不对劲按顺序查这 4 件事别乱试按「模型 → 参数 → 源文件 → 依赖」走大部分问题前三步就能定位模型选错了吗有和声的歌用了 HP2/HP3和声会被当主人声留下去混响却选了 HP5等于白跑。对照选型表换一个重跑。聚合度偏了吗伴奏里人声残留多从 10 往 12-15 调人声变薄、伴奏味太重往 8 降。每次只动 2 档听完再动。源文件质量够吗单声道、低码率、本身有严重削波的文件分离上限就在那里。换一份无损源文件再试。依赖环境全吗看「输出信息」里有没有报错堆栈torch 版本和显卡不匹配常见于 AMD 用户装错了依赖文件。更多报错含义可翻 docs/ 下对应语言的 faq。权重缺失.pth 不在 assets/uvr5_weights/怎么补「模型」下拉框是空的或者处理时报找不到模型先确认assets/uvr5_weights/里有没有以.pth结尾的权重文件Roformer 类模型是.ckpt.yaml。没有的话重新运行一次tools/dlmodels.bat或tools/dlmodels.sh脚本入口在 tools/ 下仍不行的话从项目文档里找到对应下载链接手动把权重文件放进assets/uvr5_weights/重启界面后下拉框就能选到了。 延伸玩法分离只是第一步做翻唱先用 HP3 抽出干净伴奏录上自己的声音在剪辑软件里把两轨叠到同一时间轴上对齐进拍点。清理播客先过一遍 onnx_dereverb_By_FoxJoy 去掉房间回声再用 DeEcho-Aggressive 收一遍残留双通道录音按这个顺序最干净。视频重新配音把视频音轨导出成音频文件用 UVR5 把背景音乐和原声分开留伴奏轨垫底人声轨替换成你的配音音量按段落拉平。✍️ 收尾接下来直接做这 4 件事挑一首干净的立体声歌曲用 HP3 完整跑一遍两个输出文件夹各听一遍记下残留人声和漏伴奏最严重的时间点用聚合度 12 和 8 各跑一次做对比去混响场景按 onnx_dereverb_By_FoxJoy → DeEcho-Aggressive 的顺序试一遍双通道录音分离稳定后把提出来的人声直接接到 RVC 主界面走后续变声流程【免费下载链接】Retrieval-based-Voice-Conversion-WebUIEasily train a good VC model with voice data 10 mins!项目地址: https://gitcode.com/GitHub_Trending/re/Retrieval-based-Voice-Conversion-WebUI创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
网站建设高端定制企业官网
RELATED

相关资讯

更多精彩内容,欢迎继续阅读

较早相关资讯

最新相关资讯

AI输出控制:从格式到风格的精准调控技巧 2026/9/19 8:47:46

AI输出控制:从格式到风格的精准调控技巧

1. 项目概述:驯服AI输出的必要性在AI交互领域,我们常常遇到这样的困境:精心设计的提示词却得到杂乱无章的回复,专业场景需要严谨表述却收到口语化内容,或是需要特定格式输出时AI却自由发挥。这种现象我称之为"野性…

阅读更多 →
OpenTofu 全局 Provider 缓存并发安全:文件锁(flock)机制设计与实现解析 2026/9/19 8:47:46

OpenTofu 全局 Provider 缓存并发安全:文件锁(flock)机制设计与实现解析

OpenTofu 全局 Provider 缓存并发安全:文件锁(flock)机制设计与实现解析 【免费下载链接】opentofu OpenTofu lets you declaratively manage your cloud infrastructure. 项目地址: https://gitcode.com/gh_mirrors/op/opentofu 导读…

阅读更多 →
ST-Link V2不只能烧录:一个USB口实现多通道串口调试的完整指南 2026/9/19 8:47:46

ST-Link V2不只能烧录:一个USB口实现多通道串口调试的完整指南

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

阅读更多 →
Pandoc Typst 读取器深入解析:`include` 指令与 `figure` 图形的转换机制 2026/9/19 8:47:46

Pandoc Typst 读取器深入解析:`include` 指令与 `figure` 图形的转换机制

Pandoc Typst 读取器深入解析:#include 指令与 #figure 图形的转换机制 【免费下载链接】pandoc Universal markup converter 项目地址: https://gitcode.com/gh_mirrors/pa/pandoc 导读 本篇以 pandoc 仓库中的命令测试用例 test/command/11090.md 为线索&…

阅读更多 →
OCC WebGL编译实战:FreeType配置与静态库生成避坑指南 2026/9/19 8:47:46

OCC WebGL编译实战:FreeType配置与静态库生成避坑指南

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

阅读更多 →
PyPTO CODEGEN 组件经验:3 层嵌套 pypto.loop 的 workspace 累积失效与 parallel=True 修复实战 2026/9/19 8:44:46

PyPTO CODEGEN 组件经验:3 层嵌套 pypto.loop 的 workspace 累积失效与 parallel=True 修复实战

PyPTO CODEGEN 组件经验:3 层嵌套 pypto.loop 的 workspace 累积失效与 parallelTrue 修复实战 【免费下载链接】pypto-gym PyPTO-Gym 是基于 PyPTO 编程框架构建的算子与模型样例仓库 项目地址: https://gitcode.com/cann/pypto-gym 本文为 PyPTO-Gym 算子开…

阅读更多 →

今日资讯

本周资讯

本月资讯

看完文章仍有疑问?

联系尧图顾问,获取一对一建站咨询

立即免费咨询 📞 400-888-8888
📞