乐于分享
好东西不私藏

全网最狠的免费AI音轨分离工具!可分离53轨乐器!被我优化到3G显存也能流畅跑了!

全网最狠的免费AI音轨分离工具!可分离53轨乐器!被我优化到3G显存也能流畅跑了!

💡 开发初衷

在音频处理与音乐制作的过程中,我一直在寻找高效、干净的音轨分离方案,这款软件的诞生源于我在MSST和各类人声乐器分离软件实际使用中的三个核心痛点
解决文件名整理的痛苦:早期的 MSST-GUI 每次分离完音频后,文件名与目录极其繁乱。为了解决这个问题,我最初专门开发过一个“MSST整理助手”,用来二次归类和重命名导出文件。但每次都需要多走一步流程,非常繁琐。
53 轨超大模型的显存噩梦:后来我尝试引入开源的 53 轨全乐器精细拆分模型,虽然分离能力惊人,但对显存的要求极其苛刻!即使我使用高达 20GB 显存 的顶级显卡,在处理长音频时依然极易触发 CUDA Out of Memory (显存爆满崩溃)。
空白音轨的无效堆叠:53 轨模型每次都会强行导出 53 个音频文件,而对于大部分歌曲来说,其中近一半都是没有对应乐器的静音空白轨,手动筛选删减的过程极其痛苦。
于是,这款软件诞生了。
我重新重构了 MSST 的底层推理流水线,加入了动态分块推理、空白轨智能剔除、全路径离线保护与硬件平滑降级,旨在彻底解决上述痛点,并测试与探索 MSST 模型究竟最低能下探支持到多小显存的显卡!
上图:3G显存极限测试

🔥 核心功能特点

智能剔除空白轨:独家集成静音阈值检测,自动跳过没有声部的空轨道,不再导出无效垃圾文件。
极佳的显存控制:支持动态分块(Chunking)与 FP16 混合精度,配合自定义分块时长,彻底告别小显存显卡爆显存的尴尬(最低测试到GTX1060 3G显存);支持极端情况下的 CPU 兜底模式。
支持 53 轨与 6 轨一键zip打包:分离完成后自动将所有子分轨打包为 .zip 压缩包,方便传输与归档(建议mp3格式输出)。
免预转码与格式无损导出:支持各类主流音视频直接拖入(自动跳过 wav/mp3/flac 的无谓转码),支持无损 .wav 与高码率 .mp3 导出。
全平台硬件兼容:原生支持 NVIDIA CUDA 加速,后续可能会适配 AMD 显卡(DirectML 算子但尚无条件测试),旧显卡与低配电脑平滑降级。

🎹 53 轨全乐器精细拆分清单

开源53 轨模型能够将复杂的混音音频,精细拆解为以下 53 种独立的乐器与声部(软件内已集成轨道名自动汉化):
人声与和声类(5轨):主唱人声 (lead-vocal)、背景和声 (back-vocal)、男声 (male_vocals)、女声 (female_vocals)、通用人声 (vocal/vocals)
打击乐与鼓组类(9轨):底鼓 (kick)、军鼓 (snare)、踩镲 (hh)、嗵鼓 (toms)、定音鼓 (timpani)、康加鼓 (congas)、铃鼓 (tambourine)、三角铁 (triangle)、通用打击乐 (percussion/drums)
键盘与合成器类(6轨):钢琴 (piano)、数码钢琴 (digital-piano)、管风琴 (organ)、羽管键琴 (harpsichord)、合成器 (synth)、通用键盘 (keys)
吉他与弹拨乐类(9轨):原声吉他 (acoustic-guitar)、电吉他 (electric-guitar)、多布罗吉他 (dobro)、班卓琴 (banjo)、曼陀林 (mandolin)、尤克里里 (ukulele)、西塔琴 (sitar)、竖琴 (harp)、通用吉他 (guitar)
贝斯与低音类(3轨):低音提琴 (double-bass)、电贝斯 (bass)、通用低音
弓弦乐器类(6轨):小提琴 (violin)、中提琴 (viola)、大提琴 (cello)、拉弦乐器 (bowed_strings)、弦乐合奏 (strings)、混响效果
木管乐器类(8轨):长笛 (flute)、双簧管 (oboe)、单簧管/黑管 (clarinet)、巴松管/大管 (bassoon)、萨克斯 (saxophone)、口琴 (harmonica)、手风琴 (accordion)、木管合奏 (woodwind/wind)
铜管乐器类(6轨):小号 (trumpet)、长号 (trombone)、圆号 (french-horn)、大号 (tuba)、铜管合奏 (brass)、风铃/钟琴 (bells/glockenspiel/wind-chimes)
其他类(1轨:其他未分类乐器 (other/accompaniment)

🚀 简单使用说明

导入文件:将单个/多个音频文件、视频文件或整个文件夹直接拖入界面上方的虚线区域(或点击虚线框手动选择文件)。
选择模式:在“分离模式”下拉框中选择您需要的功能(如:人声伴奏分离、翻唱和声提取、53 轨乐器拆分等)ai翻唱建议使用人声伴奏和声快速分离。
调整参数(可选):根据显存大小调整“分块时长”或勾选“zip打包”。
开始分离:点击 [开始音频分离处理] 按钮,等待进度条走完。
获取结果:处理完成后,系统会自动为您打开导出成果所在的 output 文件夹。

⚙️ 界面配置选项详细介绍

分离模式 (Mode)
人声伴奏快速分离 (低配电脑):基于 Demucs 算法,速度极快,CPU 也能轻松跑,适合快速提取主伴奏。
人声伴奏分离 (人声包含和声与混响):标准人声/伴奏二分轨,人声保留完整情感细节。
人声伴奏和声快速分离 (翻唱专用):二次流水线,精准剥离出“主唱人声”与“背景和声”,SVC/RVC翻唱神器
人声伴奏和声精细分离:三阶段流水线,在剥离和声的同时,对主唱人声进行深度去混响处理。
男声女声精细分离:针对对唱歌曲,自动将人声精细拆分为“男声音轨”与“女声音轨”。
单独音频降噪 / 去混响处理:不进行音轨分离,仅对音频进行纯净降噪或去除房间混响。
6音轨简单分离 (低配电脑):快速拆分为:人声、鼓组、贝斯、吉他、钢琴、其他乐器 6 个基础轨道。
53轨全乐器精细拆分:超强全乐器拆分,包含小提琴、长笛、萨克斯、手风琴、数码键盘等 53 种乐器细分。
基础导出设置
导出格式:可选 .wav(无损原音质,推荐)或 .mp3(体积小,方便传输)。
包含原文件名前缀:勾选后导出的文件名格式为 歌曲名_人声.wav;取消勾选后仅为 人声.wav。
汉化分轨名:自动将英文轨名(如 vocals, acoustic-guitar)翻译为中文(如 人声, 原声吉他),清晰直观。
自动打开输出目录:任务全部完成后,自动弹出文件夹,省去手动寻找的麻烦。
zip打包分轨 (仅53轨及6轨):勾选后,会将导出的多轨文件夹自动压缩为一个 歌曲名_分轨.zip 压缩包。
高级硬件与算法参数
分块时长(s):(53轨需要设置,其他的分离显存够用设为0即可) 默认 15 秒。
FP16 混合精度:勾选后使用半精度浮点计算,显存占用直接减半,计算速度显著提升(小显存推荐勾选)。
跳过静音分轨:(解决痛点项) 默认勾选。开启后,若分离出的轨道无声(静音),将自动跳过导出,拒绝导出无用垃圾文件。
静音阈值 db:判断是否为静音轨度的能量分贝界限,默认 -45 dB。数字越小(如 -60)判定越严格。
CPU处理(慢):(极端兜底项) 默认不勾选。当您的显卡显存极小(如 2G)无法将大模型载入显存时,勾选此项可强制绕过显卡显存,完全使用系统内存与 CPU 进行计算,保底完成分离任务!

📝 结语

这款软件不仅仅是一个简单的 UI 壳子,更是我对音频分离算法性能极限的一次摸索。希望它能帮你摆脱整理文件名的繁琐,告别爆显存的烦恼,真正享受 AI 音乐制作的乐趣!
软件下载地址:
‬⁠⁠‬⁠‌‍‍‌⁠‍⁠‍‍⁠‬‬⁠‬⁠⁠‍https://aimusiclab.feishu.cn/wiki/TqtJwwVX5iCCM8kdwH7cNWbTnOc
(全文完)
    我是乔大峰,AI音乐实验室主理人,拥有10+年互联网全栈开发与网络安全经验,曾深度受访于新华社专题报道,专注于人工智能与智能体的前沿应用。致力于通过系统化的工具和实战技巧分享,打破专业壁垒,助力零基础爱好者释放音乐潜能,共同探索人机协同重塑艺术表达的无限可能。
https://h.xinhuaxmt.com/vh512/share/12985896
关注公众号 “乔大峰”,获取更多AI音乐创作技巧、工具和资源!
我会定期分享最新资讯和实用教程,助你玩转AI音乐创作!
如果您觉得我的教程帮到了你,并且希望帮助到更多的AI音乐人,
请帮忙点亮底部的推荐,支持一下AI音乐实验室 非常感谢!

感谢您看到这里 ,我们贴心为AI音乐新手准备了文档,希望你创作愉快!

https://aimusiclab.feishu.cn/wiki/NhLswjjsHiT2qVk3q8qcwxO7nhf