软件介绍
Ultimate Vocal Remover 5(UVR5)是一款专业的AI智能音频源分离工具,依托多种高性能AI模型,主打高精度音频分离处理,支持人声、伴奏、各类乐器音轨拆分,同时具备音频优化、格式转换等功能。软件支持GPU硬件加速,适配多种音频格式,参数可灵活自定义,广泛适用于歌曲干声提取、伴奏制作、音频后期处理等场景。
软件下载
- https://www.yuntts.com/995.html
- https://www.yuntts.com/102.html
顶部区域
- Select Input:选择输入音频,支持 m4a、mp3、wav、flac 等。
- Select Output:输出保存路径,如输出到桌面。
- 输出格式选择:
WAV / FLAC / MP3
- WAV:无压缩,音质最好,做后期首选;
- FLAC:无损压缩;
- MP3:体积小,有损。
核心算法与参数
CHOOSE PROCESS METHOD(处理算法)
当前:MDX‑Net,擅长人声伴奏分离;
下拉还可以选:Demucs、Roformer(你之前补丁就是这个)、VR‑Arch 等不同 AI 模型。
- SEGMENT SIZE(片段大小):当前 320
越大占用显存越高,分离效果更好;显存小就调小(128/256);大显存 320‑512。 - OVERLAP(重叠度):当前 15
片段之间重叠,数值越高拼接断层越少,处理速度变慢,一般 10‑20。
CHOOSE MDX‑NET MODEL(模型)
当前:MDX23C‑InstVoc HQ,MDX23C 系列,专门分离「伴奏 + 人声」,HQ = 高质量版本。
复选框选项
✅ GPU Conversion:开启显卡 GPU 加速,N 卡 CUDA 生效;不勾选就只用 CPU 跑,速度很慢。
Vocals Only:只输出人声文件Instrumental Only:只输出伴奏文件
截图两个都没勾选:会同时输出【人声】+【伴奏】两个文件。
Sample Mode(30s):采样模式,只处理前 30 秒,用来快速试参数,不完整导出整首歌。
SELECT SAVED SETTINGS
保存 / 加载整套参数预设,不用每次手动调参数。
下方状态栏(日志)
Loading model... Done! #加载AI模型完成
Running inference... #正在AI推理运算(就是分离音频)
Process Progress:23% #整体进度23%
左下角扳手图标:开始处理;右下角方块:停止任务。
小提示
- MDX23C 对伴奏提取不错,但想要更好效果,打上你之前的
small_rofo补丁后,可以切换到 BS‑Roformer‑ViperX 模型,分离干净度会更强。 - 50 系显卡要确认 CUDA12.8 环境正常,GPU Conversion 才会真正调用显卡。
- 如果显存溢出报错,把
SEGMENT SIZE从 320 降低到 256 或者 128。
声明:本站所有文章,如无特殊说明或标注,均为本站原创发布。任何个人或组织,在未征得本站同意时,禁止复制、盗用、采集、发布本站内容到任何网站、书籍等各类媒体平台。如若本站内容侵犯了原著者的合法权益,可联系我们进行处理。


评论(0)