StemDeck:本地把一首歌拆成 6 条音轨,不注册,不上传
StemDeck 这点挺直接,开源、免费、本地跑,README 里写得也很白:no account、no upload、no subscription。把 MP3、WAV、FLAC 丢进去,就能拆成人声、鼓、贝斯、吉他、钢琴和其他乐器,最多 6 条 stem。也支持粘 YouTube URL,但这个别乱用,得处理自己有权处理的内容。
啧,重点其实不是“AI 分离”这四个字。
现在网上一堆人声提取工具,看着免费,点两下就开始让你登录,第三下告诉你高清导出要订阅。StemDeck 走的是另一条路:用 Demucs 的 htdemucs_6s 模型在本机拆轨,NVIDIA 显卡走 CUDA,Apple Silicon 走 MPS,不行就 CPU 顶上。
先别急着吹。CPU 当然能跑,但慢是肯定的;第一次还要下载运行时、FFmpeg 和模型包,模型大概 170MB。老鬼以前折腾这类本地工具,最烦的不是第一步跑起来,是第二次打开时路径、依赖、缓存各种小问题。StemDeck 至少把 Windows 和 macOS 的包都准备好了,普通用户不用自己装 Python,这个细节挺救命。
拆完以后,它不是只丢给你几个 wav 文件就完事。
里面带了个多轨混音器,可以每条音轨单独调音量、静音、solo,波形能缩放,还能圈一段循环听。想扒鼓、练贝斯、做人声伴奏,基本就是这些动作反复来回。导出也不只是一条 stem,可以导单轨,也可以把选中的几条重新混成 mix.wav。
我比较在意的还有一个边界:它不是要替代 Moises、LALAL.AI 这类商业工具。README 自己也承认,商业产品在速度、移动端、额外音乐功能和整体打磨上更强。StemDeck 更像是给不想上传音频、不想办账号、偶尔拆歌练习的人留了一个本地方案。
适合谁?音乐练习、扒谱、做 remix 草稿、剪视频前想单独拿人声或鼓点的人。
Github地址:stemdeckapp/stemdeck