这些场景你多半遇到过:乐队想翻一首歌,到处找不到编曲对的伴奏。合唱团指挥想要一条干净的人声用来教声部。一场现场演出录成了双轨,现在人声需要跟吉他不一样的混响。原始工程没了——鼓手那台旧笔记本带着它们一起去世了。
十年前的答案是"拆不了,抱歉"。现在的答案是右键。
在 Tutti 里怎么做
把歌拖进项目,右键 clip,两个选项:
- Separate Vocals (AI)——拆成人声和其余所有东西。卡拉 OK 操作,两个方向都行。
- Separate Stems (AI)——拆成四份:鼓、贝斯、人声、"other"(吉他、键盘、合成器,旋律类的剩余部分)。
拆出来的部分作为新轨道进入会话,和原始素材对齐,直接静音、挂 EQ、往上叠录都行。
底层是 Demucs v4——MVSEP 排行榜上被反复跑分的那个模型家族——通过 WebGPU 完全在你的浏览器里运行。这一点比听起来重要:音频从头到尾没离开你的电脑,不会上传给我们或任何人。素材是没发行的歌、或者客户的东西时,这正是你需要的。
该有什么预期
第一次跑要下载模型,大约 120 MB。 一次性开销,之后有缓存。你让 Muse(内置助手)去拆的话,它也会先提醒你这件事。
分离耗时约等于素材长度。 四分钟的歌大概跑四分钟。点下去,先去调你的琴。进度指示会告诉你跑到哪了。
质量是真的好,但不是魔法。 现代混音里的人声拆出来通常干净得吓人。鼓和贝斯一般也扎实。"other" 这一桶是稠密编曲糊掉的地方——两把失真吉他和一层合成器 pad 挤在一个 stem 里,是分不回去的。另外,混响很重的人声会在伴奏里留下一层混响的鬼影,因为那混响本来就是其他声道画面的一部分。
大家实际拿它干什么
排练伴奏(把你自己演奏的乐器静音)。教声部(solo 人声 stem,循环中音声部)。Remix 和 edit。事后抢救双轨现场录音。工程丢了之后采样自己发行过的老歌——这个用途比任何人愿意承认的都常见。
法律脚注,反正会有人问:拆一首商业歌曲私下练习是一回事;用拆出来的 stems 做东西公开发行,需要的授权跟采样一模一样。技术变容易了,版权没有。
