拓冰建站拓冰建站
首页 / 资讯中心 / 正文

10分钟装好Ultimate Vocal Remover:AI人声伴奏分离完整部署指南

10分钟装好Ultimate Vocal RemoverAI人声伴奏分离完整部署指南【免费下载链接】ultimatevocalremoverguiGUI for a Vocal Remover that uses Deep Neural Networks.项目地址: https://gitcode.com/GitHub_Trending/ul/ultimatevocalremoverguiUltimate Vocal RemoverUVR用深度学习模型把一首歌拆成人声轨和伴奏轨MDX-Net、Demucs、VR 三系列分离模型内置即用无需自己训练或下载权重。读完本文你可以完成环境自检、装好 v5.6.0并跑通第一首歌的分离拿到人声与伴奏两个成品文件。环境自检清单本节帮你确认机器能不能跑装之前先逐项打勾操作系统 64 位Windows 10 及以上、macOS Big Sur 及以上、Ubuntu 20.04 及以上Debian/Arch 系均可内存 8GB 起分离长曲时余量越大越稳NVIDIA 显卡至少 RTX 1060 6GB这是 GPU 加速的最低门槛推荐 8GB 显存没有独显可以 CPU 跑只是慢磁盘预留约 50GB装依赖和模型后会占不少这些模型计算量不小自检过不了前两条时建议先升级硬件再装。最快安装路径本节给三个平台的最小可运行步骤新手直接用打包版只列 Linux 需要手动装源。Windows下载UVR_v5.6.0_setup.exe双击安装⚠️ 必须装在 C 盘根目录装到其他盘会不稳定AMD Radeon 或 Intel Arc 显卡改用UVR_v5.6.0_setup_opencl.exe。安装包内置 Python、PyTorch 等全部依赖无需前置环境。macOSM 系列芯片下Ultimate_Vocal_Remover_v5_6_MacOS_arm64.dmgIntel 芯片下Ultimate_Vocal_Remover_v5_6_MacOS_x86_64.dmg打开后拖进 Applications 即可。首次启动要初始化 5-10 分钟耐心等它完成。Linux没有打包版从源码装最快。先克隆仓库再按发行版装系统依赖git clone https://gitcode.com/GitHub_Trending/ul/ultimatevocalremovergui sudo apt install ffmpeg python3-pip python3-tk pip3 install -r requirements.txt python3 UVR.pyArch/Manjaro 把 apt 那行换成sudo pacman -S python-pip tk ffmpeg然后跑仓库自带的 install_packages.sh 装 Python 依赖。手动安装这条路同时是 Windows/macOS 高级用户的备选要点就是 requirements.txt 锁死了 librosa 0.9.2、numpy 1.23.5、scipy 1.9.3、pyrubberband 0.3.0 等版本装依赖报冲突时按它来别自己改版本号。第一次使用走查本节从启动界面带你产出第一个分离文件全程点鼠标即可。启动后进入上图主界面点Select Input选中一首歌MP3、FLAC 都行非 WAV 格式由内置的 FFmpeg 负责转码。点Select Output选输出目录格式选 WAV 最稳。CHOOSE PROCESS METHOD 保持 MDX-Net模型选默认的 MDX23C-InstVoc HQ想分 vocals/drums/bass/other 四轨再换 Demucs v4。有 NVIDIA 显卡就勾上GPU ConversionSegment Size 256、Overlap 8 保持默认不要一开始就动参数。点Start Processing首次要加载模型可能等几十秒到几分钟进度走完后输出目录里就是人声轨和伴奏轨两个文件用播放器直接听。Settings 扳手按钮里可以保存参数预设应用关闭时也会自动记忆上次的设置不用每次重配。性能与参数调优本节把加速和调参合并讲按你的硬件对号入座NVIDIA 显卡装对应 CUDA 版本的 PyTorch手动安装时pip install --upgrade torch --extra-index-url https://download.pytorch.org/whl/cu117勾 GPU Conversion 后速度提升数倍。Apple SiliconMPS 加速自动启用已覆盖 Demucs v4 和全部 MDX-Net 模型无需任何操作。AMD Radeon / Intel Arc走 OpenCL 版本目前支持有限预期别拉太高。报内存分配错误把 Segment Size 从 256 往下调如 128再不行调小 Window这是官方给出的标准解法。模型取舍要人声/伴奏两轨选 MDX-Net快要四轨精分选 Demucs耗时更长。常见问题macOS 双击打不开应用怎么办Gatekeeper 拦截了未公证的二进制。先临时允许所有来源再移除隔离属性sudo spctl --master-disable sudo xattr -rd com.apple.quarantine /Applications/Ultimate\ Vocal\ Remover.app点 Start 后报错提示 FFmpeg 找不到原因非 WAV 文件全靠 FFmpeg 转码缺了它 WAV 能处理、MP3 必挂。Linux 按上文装ffmpeg包即可Windows 手动安装的话把官方编译版里的ffmpeg.exe拷到 UVR 应用目录。处理中途抛内存分配错误Segment 或 Window 对当前内存太大。调小这两项重跑即可长曲建议一开始就先用 128 试。没有独立显卡能跑吗能CPU 推理完整可用只是分离一首歌可能要按小时计适合不赶时间的场景。首次启动要等 5-10 分钟是正常的吗正常首次启动要做初始化和依赖检查尤其 MacBook 用户第二次启动就是秒开。下一步跑通第一首分离后建议把常用参数存成预设再翻一遍 models/ 目录里面按 Demucs_Models、MDX_Net_Models、VR_Models 列着各系列模型的配置清单可以按曲目类型挑更合适的模型。完整版本记录见 变更日志源码和 Issue 都在仓库 https://gitcode.com/GitHub_Trending/ul/ultimatevocalremovergui 。【免费下载链接】ultimatevocalremoverguiGUI for a Vocal Remover that uses Deep Neural Networks.项目地址: https://gitcode.com/GitHub_Trending/ul/ultimatevocalremovergui创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
分享:

看完干货,该让你的企业上线了

免费需求沟通 · 48 小时内出具建站方案 · 河南本地可上门