UVR 完整教程:一键人声消除与AI音频分离
UVR 完整教程一键人声消除与AI音频分离【免费下载链接】ultimatevocalremoverguiGUI for a Vocal Remover that uses Deep Neural Networks.项目地址: https://gitcode.com/GitHub_Trending/ul/ultimatevocalremovergui拿到一首混音歌曲只想把人声去掉留下伴奏传统软件拖半天还残留回音。UVRUltimate Vocal Remover是一款开源的AI音频分离图形界面工具基于深度学习模型自动拆出人声与伴奏覆盖人声消除、伴奏提取、多轨分离三类需求。⚡ UVR项目速览它是什么、适合谁用UVR是一个跨平台的图形化程序内置三套分离模型MDX-Net偏人声消除的双轨拆分、VR Architecture偏音质修复与降噪、Demucs多轨精细拆分可拆出人声、鼓、贝斯等独立轨道。它解决的是不写代码完成专业级音频分离这件事适合音乐制作人、播客创作者和普通用户。应用关闭时会自动记住你上次的设置第二次打开可以直接处理。️ 部署与首次运行安装与前置依赖通用前置要求仅支持64位系统勾选GPU Conversion需要Nvidia显卡最低RTX 1060 6GB建议8GB显存处理MP3等非WAV格式依赖FFmpeg音频处理的命令行工具。WindowsWin10及以上从项目发布页下载UVR_v5.6.0_setup.exe安装安装包已自带Python与PyTorch无需前置依赖必须安装到C盘根目录装到其他盘会导致运行不稳定Intel Pentium/Celeron处理器不保证可用AMD Radeon或Intel Arc显卡请下载OpenCL版本安装包macOSBig Sur及以上按芯片下载dmgM1/Apple Silicon选arm64版Intel选x86_64版双击安装到Applications首次启动需要5~10分钟初始化属正常现象若系统拦截启动在终端执行一条命令解除隔离sudo xattr -rd com.apple.quarantine /Applications/Ultimate\ Vocal\ Remover.appM系列芯片可勾选GPU Conversion启用MPS加速已支持Demucs v4与全部MDX-Net模型LinuxDebian/Ubuntu与Arch系git clone https://gitcode.com/GitHub_Trending/ul/ultimatevocalremovergui cd ultimatevocalremovergui sudo apt install ffmpeg python3-pip python3-tk pip3 install -r requirements.txt python3 UVR.pyArch系把apt换成pacman依次安装python-pip、tk、ffmpeg也可用仓库自带的install_packages.sh一键装依赖常见卡点漏装ffmpeg时一转换非WAV文件就报错️ 核心功能实操提取人声并导出伴奏打开主界面点Select Input选音频文件Select Output选导出目录 → Choose Process Method下拉选MDX-Net → 模型下拉选MDX23C-InstVoc HQ这类人声优化模型 → 按需求勾选Vocals Only只要人声或Instrumental Only只要伴奏→ 选导出格式WAV/FLAC/MP3 → 点Start Processing。几分钟后输出目录里得到人声、伴奏两个文件。参数怎么选Segment Size分段大小即每次送进模型计算的音频块长度默认256够用内存紧张选128追求质量可试512Overlap重叠率块与块之间的重叠程度默认8边界有痕迹时加到12~16用Demucs把一首歌拆成四轨Choose Process Method选Demucs → 模型下拉选v4系列含4轨和6轨模型→ 在轨道选项里勾选需要的Vocals/Drums/Bass/Other → Start Processing得到各条独立轨道。参数怎么选非人声轨道有人声泄漏时勾选Pre-process model先用人声模型粗分离再拆剩余轨道v5.6新增Mixer Mode对部分4轨模型能改善分离效果可对比勾选前后的输出开启GPU Conversion加速转换主界面选项区勾选GPU Conversion → 启动处理时模型自动加载到Nvidia显卡上速度明显快于CPU。参数怎么选显存低于6GB不建议勾选8GB以上体验最佳AMD/Intel Arc用户装OpenCL版安装包而不是标准版Mac M系列芯片同样通过该选项走MPS加速用Sample Mode先试听效果勾选Sample Mode (30s) → Start Processing只处理30秒片段秒数可在Additional Settings里改→ 试听满意后再取消勾选做完整转换。参数怎么选新模型、新参数组合务必先跑Sample Mode再全量处理省大量等待时间不确定选哪个模型时用样本模式对比2~3个候选锁定后再正式跑 典型场景指南从混音歌曲做一首卡拉OK伴奏适用情况只想要干净伴奏不关心鼓、贝斯等分轨。配置项推荐值处理方法MDX-Net模型MDX23C系列人声模型轨道勾选Instrumental OnlyDenoise Output勾选输出更干净耗时更长Overlap8有边界痕迹时调12~16注意Denoise Output会拉长处理时间首次大批量跑之前可以先关确认质量需要再开。为音乐制作拆分四条独立轨道适用情况混音、采样或二次创作需要人声、鼓、贝斯各自独立。方法选Demucs用v4的4轨模型轨道四项全选人声轨道想更干净时加Pre-process model输出格式选WAV避免有损格式再进工程注意Demucs v3/v4四轨模型非UVR官方团队训练不同模型效果差异较大先用Sample Mode试。低显存、低内存机器省内存跑适用情况显卡低于RTX 1060或内存8GB以下处理长曲时容易报内存错误。Segment Size降到128VR Architecture对应调Window/Crop SizeMDX-Net与VR Architecture在v5.6新增Batch Mode批量推理更省显存开启后不影响输出质量仍报错就取消GPU Conversion改用CPU并关闭其他占用显卡的程序❓ 问题排查速查表处理速度远低于预期 → 没走GPU → 确认GPU Conversion已勾选且显卡驱动为最新版Mac确认MPS生效出现内存分配错误 → Segment/Window设得太大 → 降到128重试长曲文件拆分处理转换MP3等文件直接报错 → FFmpeg未安装 → 安装ffmpegLinux执行sudo apt install ffmpeg后重启UVRMac打不开应用或提示不受信任 → 系统隔离机制 → 终端执行sudo xattr -rd com.apple.quarantine /Applications/Ultimate\ Vocal\ Remover.app处理中途崩溃、显存不足 → 显存低于模型需求 → 建议8GB显存否则降Segment Size或取消GPU Conversion报错看不懂、无法定位 → 错误信息不完整 → 点Start Processing旁的Settings按钮打开Error Log看完整日志进阶方向自定义模型与批量组合自己训练的MDX-Net/VR/Demucs模型放入models/对应子目录即可在界面下拉中选用Ensemble Mode多模型结果平均混合模式支持不限数量模型组合配置可存到gui_data/saved_ensembles/Select Saved Settings可整体保存/加载应用设置存于gui_data/saved_settings/本文不展开以上内容详见仓库对应目录。收尾UVR把AI音频分离装进了三步操作安装、选模型、点Start Processing。下一步找一首你手头的歌开Sample Mode (30s)跑一遍锁定你的模型与参数组合。【免费下载链接】ultimatevocalremoverguiGUI for a Vocal Remover that uses Deep Neural Networks.项目地址: https://gitcode.com/GitHub_Trending/ul/ultimatevocalremovergui创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考