这篇属于我们的整支乐队扒谱指南。
说到 AI 扒谱,大家最先问的往往就是这个:把一整首歌丢给它,鼓、贝斯、吉他、人声一起在响,它能不能把每件乐器的谱都写出来?这个问题其实是两个问题捆在一起问的,两个答案差得很远,没法用一句“能”或“不能”说完。
麻烦还出在一个常被混着用的词上。从一件乐器里同时读出很多个音,这叫复音,AI 做得很好,钢琴尤其如此。把一段混音里的几件不同乐器拆开,这叫多乐器扒谱,眼下最难的就是它。很多人嘴上说“多乐器”,心里想的其实是复音。复音基本已经解决了。Songscription 的模型一般都够稳,能从混音里拎出你要的那件乐器,所以一次扒一件就行,不用先拆分轨。
一个问题,其实是两个
大家说“同时扒好几件乐器”,通常指下面两种情况中的一种,而这两种差别很大。
- 同一时间的很多个音,来自一件乐器,比如钢琴上一个很厚的和弦。这是复音扒谱,AI 在这方面已经相当拿手。
- 同一时间的很多件乐器,混在一段录音里,比如一整支乐队。这得先把录音拆回各个音源再扒,这一步很难。
两件事一搅在一起,这个话题就说不清了。一个工具可以第一件做得很出色,第二件照样吃力,因为这是两种本事。第一件事我们在单音与复音扒谱那篇里讲得更细。
一次很多个音:复音
读出一叠同时响起的音,就是复音扒谱,也是现在 AI 最出彩的地方。钢琴弹一个五个音的和弦,底下还有一条内声部在走,这种音又密、又叠在一起的音乐,以前得靠耳朵练过的人花好长时间才扒得开。好的模型能读得干干净净。所以,如果你说的“好几个”指的是一架钢琴上那种很满、好几条线一起走的弹法,那答案就是能,而且把握很大。钢琴复音扒谱是怎么做到的,为什么钢琴最适合,可以看我们的钢琴复音扒谱详解。
一次很多件乐器:更难的问题
整支乐队的录音把几件乐器混成了一路声音,它们的频率互相重叠、互相遮盖。要把每件乐器写到各自的谱表上,系统得先把混音拆回各个部分,再一件件扒,最后还要决定怎么排版。每一步都会带进误差,遮盖又让一些细节在混音里就已经丢了。所以,没有哪个工具能随便拿一首完整的歌,按一下按钮就变成一份毫无差错、每件乐器都分得清清楚楚的管弦乐谱。这件事还在研究的最前沿,远没有解决,老实的工具都会这么告诉你。
实际怎么做
现在要从多乐器录音里拿到好读的乐谱,有两条靠得住的路,看你真正想要什么来选。
- 想要分开的各个分谱? 每件乐器单独扒,用和它对应的模型。这些模型一般都够稳,能从整首混音里拎出你要的乐器,所以不用先把歌拆成分轨。碰上特别密的录音,也可以另外先分离分轨,扒出来会更干净。
- 想要一份能直接弹的乐谱? 把录音扒成一份合并的谱子,通常是钢琴缩编谱,把旋律、和声和低音都收到一个大谱表上。这样更快,很多时候弹的人要的也就是这个。
逐件乐器那条路,把多轨音频扒成乐谱这篇一步步讲过;合并乐谱那条路,看扒一整支乐队的录音。不管走哪条,都可以用音频转乐谱从任意一段录音开始。
Songscription 能扒哪些乐器
Songscription 按乐器分模型来扒谱。钢琴模型最成熟,处理密集的复音最好。新一些的模型能扒吉他、贝斯和鼓,还有小号、萨克斯、小提琴这类旋律线条;人声还在试验阶段。一次扒一个部分,比让一个模型一口气扒整支乐队更准。碰上特别密的录音,另外先分离分轨,能让某个部分更清楚。只扒一个部分的话,可以看我们写的扒贝斯线和用 AI 扒鼓,里面有逐件乐器扒谱的实际做法。
常见问题
AI 能同时扒好几件乐器的谱吗?
要看你指的是哪一种。一件乐器同时发出很多个音,AI 处理得很好,钢琴的复音扒谱就是这样。把一段混好的录音里几件不同的乐器拆开,各自写成分谱,就难得多,这也是这个领域眼下最前沿的难题。现在最实际的做法是一次扒一件乐器。Songscription 的模型一般都够稳,能从整首混音里把你要的那件乐器单独拎出来,所以不用先把歌拆成分轨。你也可以把整首扒成一份合并的谱子,比如钢琴缩编谱,只想要个能弹的版本时这样更快。
复音扒谱和分离乐器有什么区别?
复音扒谱,是从同一个声源里听出同时响着的几个音,比如钢琴上的一个和弦,再把它们全部记下来。音源分离,是在扒谱之前先把一段混好的录音拆回各件乐器:人声、贝斯、吉他。这是两个不同的问题,一个是听清叠在一起的音,一个是把混好的录音再拆开。扒多件乐器通常两样都要做,所以比扒一段只有一件乐器的干净录音要难。
一首有好几件乐器的歌,怎么扒谱?
有两条实际可行的路。想要各自独立的分谱,就一件一件地扒。Songscription 的模型一般都够稳,能从整首混音里拎出你要的那一部分,所以不用先拆分轨;碰上特别密的录音,也可以另外先分离分轨,扒出来会更干净。想要一份能直接弹的乐谱,就把录音扒成合并的版本,通常是钢琴缩编谱,把旋律、和声和低音都收到一个大谱表上。按目标来选:要一份分乐器的乐谱,就分开扒;只想自己弹,就扒成一份。
Songscription 能扒哪些乐器?
钢琴模型最成熟,处理又密又多音的弹奏效果最好。新一些的模型能扒吉他、贝斯、鼓,还有小号、萨克斯、小提琴这类旋律线条;人声还在试验阶段。这些模型一般都够稳,能从整首混音里拎出你要的乐器,所以你可以一次扒一个部分,不用先把歌拆成分轨。碰上特别密的录音,另外先分离分轨,扒出来的部分还能更干净。
