软件介绍

Ultimate Vocal Remover 5(UVR5)是一款专业的AI智能音频源分离工具,依托多种高性能AI模型,主打高精度音频分离处理,支持人声、伴奏、各类乐器音轨拆分,同时具备音频优化、格式转换等功能。软件支持GPU硬件加速,适配多种音频格式,参数可灵活自定义,广泛适用于歌曲干声提取、伴奏制作、音频后期处理等场景。

Ultimate Vocal Remover插图

软件下载

  • https://www.yuntts.com/995.html
  • https://www.yuntts.com/102.html

顶部区域

  1. Select Input:选择输入音频,支持 m4a、mp3、wav、flac 等。
  2. Select Output:输出保存路径,如输出到桌面。
  3. 输出格式选择WAV / FLAC / MP3
  • WAV:无压缩,音质最好,做后期首选;
  • FLAC:无损压缩;
  • MP3:体积小,有损。

核心算法与参数

CHOOSE PROCESS METHOD(处理算法)

当前:MDX‑Net,擅长人声伴奏分离;
下拉还可以选:Demucs、Roformer(你之前补丁就是这个)、VR‑Arch 等不同 AI 模型。

  • SEGMENT SIZE(片段大小):当前 320
    越大占用显存越高,分离效果更好;显存小就调小(128/256);大显存 320‑512。
  • OVERLAP(重叠度):当前 15
    片段之间重叠,数值越高拼接断层越少,处理速度变慢,一般 10‑20。

CHOOSE MDX‑NET MODEL(模型)

当前:MDX23C‑InstVoc HQ,MDX23C 系列,专门分离「伴奏 + 人声」,HQ = 高质量版本。

复选框选项

GPU Conversion:开启显卡 GPU 加速,N 卡 CUDA 生效;不勾选就只用 CPU 跑,速度很慢。

  • Vocals Only只输出人声文件
  • Instrumental Only只输出伴奏文件

截图两个都没勾选:会同时输出【人声】+【伴奏】两个文件。

  • Sample Mode(30s):采样模式,只处理前 30 秒,用来快速试参数,不完整导出整首歌。

SELECT SAVED SETTINGS

保存 / 加载整套参数预设,不用每次手动调参数。

下方状态栏(日志)

Loading model... Done!  #加载AI模型完成
Running inference...    #正在AI推理运算(就是分离音频)
Process Progress:23%    #整体进度23%

左下角扳手图标:开始处理;右下角方块:停止任务。

小提示

  1. MDX23C 对伴奏提取不错,但想要更好效果,打上你之前的small_rofo补丁后,可以切换到 BS‑Roformer‑ViperX 模型,分离干净度会更强。
  2. 50 系显卡要确认 CUDA12.8 环境正常,GPU Conversion 才会真正调用显卡。
  3. 如果显存溢出报错,把SEGMENT SIZE从 320 降低到 256 或者 128。
声明:本站所有文章,如无特殊说明或标注,均为本站原创发布。任何个人或组织,在未征得本站同意时,禁止复制、盗用、采集、发布本站内容到任何网站、书籍等各类媒体平台。如若本站内容侵犯了原著者的合法权益,可联系我们进行处理。