程序员老鬼

StemDeck:本地把一首歌拆成 6 条音轨,不注册,不上传

老鬼看这种音频工具,第一反应不是“分离效果多神”,而是:它要不要我注册?音频会不会传云端?导出还要不要掏钱?

StemDeck 这点挺直接,开源、免费、本地跑,README 里写得也很白:no account、no upload、no subscription。把 MP3、WAV、FLAC 丢进去,就能拆成人声、鼓、贝斯、吉他、钢琴和其他乐器,最多 6 条 stem。也支持粘 YouTube URL,但这个别乱用,得处理自己有权处理的内容。

啧,重点其实不是“AI 分离”这四个字。

Image

现在网上一堆人声提取工具,看着免费,点两下就开始让你登录,第三下告诉你高清导出要订阅。StemDeck 走的是另一条路:用 Demucs 的 htdemucs_6s 模型在本机拆轨,NVIDIA 显卡走 CUDA,Apple Silicon 走 MPS,不行就 CPU 顶上。

先别急着吹。CPU 当然能跑,但慢是肯定的;第一次还要下载运行时、FFmpeg 和模型包,模型大概 170MB。老鬼以前折腾这类本地工具,最烦的不是第一步跑起来,是第二次打开时路径、依赖、缓存各种小问题。StemDeck 至少把 Windows 和 macOS 的包都准备好了,普通用户不用自己装 Python,这个细节挺救命。

拆完以后,它不是只丢给你几个 wav 文件就完事。

Image

里面带了个多轨混音器,可以每条音轨单独调音量、静音、solo,波形能缩放,还能圈一段循环听。想扒鼓、练贝斯、做人声伴奏,基本就是这些动作反复来回。导出也不只是一条 stem,可以导单轨,也可以把选中的几条重新混成 mix.wav。

我比较在意的还有一个边界:它不是要替代 Moises、LALAL.AI 这类商业工具。README 自己也承认,商业产品在速度、移动端、额外音乐功能和整体打磨上更强。StemDeck 更像是给不想上传音频、不想办账号、偶尔拆歌练习的人留了一个本地方案。

适合谁?音乐练习、扒谱、做 remix 草稿、剪视频前想单独拿人声或鼓点的人。

Github地址:stemdeckapp/stemdeck