本文属于我们的各种乐器扒谱指南系列。
大多数人早在会把旋律写下来之前,就已经会唱了。早上醒来脑子里有段调子,怕忘了就对着手机唱下来,然后它就一直躺在那里,成了一个你有点不敢删的音频文件。以前要把这段唱出来的旋律变成乐谱,得坐在琴前一个音一个音地试。现在 AI 扒谱能听一段人声录音,直接把旋律写在五线谱上交给你。
唱出来的旋律,为什么比想象中难扒
钢琴对扒谱模型很友好:按下一个键,音从一个确定的音高开始,再按能预料的方式衰减。人声几乎哪一样都做不干净。我们唱歌时会从下面滑进一个音,再从音尾滑出去;会故意加颤音,让音高来回晃;还会在一个音节上唱好几个音,这叫拖腔。换气声和辅音又会把旋律打断,这些声音本身根本没有音高。模型要判断一个音在哪儿结束、下一个音从哪儿开始,一段很有表现力的演唱在它听来,可能就是一条又长又不稳的滑线,排不成整整齐齐的一串音高。
这些都不至于让人声没法扒。它们只是说明了人声扒出来的谱为什么要比钢琴多检查一点,也告诉你检查时该看哪里。唱得越干净、越有意识,第一版草稿就越准。单条旋律和密集的织体扒起来难度不一样,每种乐器都是这样。我们在单声部与多声部扒谱那篇里讲过这个差别,单独一条人声旋律属于好对付的那一类。
人声模型能扒准的部分
好在大多数靠唱记下来的想法,正好属于好对付的情况:一个人,一条旋律,没有和声要拆开。给模型一段唱得清楚的旋律,轮廓能出来,长音的音高能落准,冲杯咖啡的工夫,这首曲子的大致样子就已经在五线谱上了。手里攥着一段主旋律的写歌人,想把自己声部写出来的合唱团成员,或者只想把想法存成乐谱的人,要的正是这一部分。
在 Songscription 的几个模型里,人声模型是最新的,还标着实验性;做得最成熟的是钢琴模型。实际用起来,干净简单的人声旋律能扒得很好,又快、装饰又多的旋律就得多花点工夫整理,这一点哪个工具都一样。
怎么录才能扒得干净
录音时做的几个选择,比之后调任何设置都管用:
- 一个音就唱一个音。 记想法的时候,先忍住别滑、别往上勾。表现力以后可以再加回去,模型只需要听清一个个分开的音高。
- 换成中性的音节。 哼唱,或者用“啊”“啦”这样的开口元音来唱,音高会比唱完整歌词更干净,因为硬辅音会让声音短暂断掉。
- 干一点,近一点。 房间安静、混响少,麦克风离得近一些,模型拿到的信号最清楚。
- 速度稳住。 用脚打拍子,或者跟着很小声的节拍器唱,节奏才能扒对,不会变成一堆奇怪的时值。
- 把人声单独拿出来。 如果人声埋在伴奏里,最省事的办法是扒一段只有人声的录音。
从录音到主旋律谱
流程本身很短。Songscription 会从录音里分离出单独一条旋律,写成能直接在浏览器里编辑的乐谱。处理人声用的是单独的模型,专门针对唱和哼的输入,跟钢琴模型分开。上传录音,乐器选人声,让它知道自己听的是人声,然后开始扒。一两分钟后,旋律就在五线谱上摆在你面前了。如果人声底下还有伴奏,和弦识别可以在谱表上方加上和弦符号,光秃秃的旋律就成了一份像样的主旋律谱。这种旋律加和弦的谱子,大多数歌手和乐队都在用。
接下来就看你怎么改了。把它移到适合歌手的调;想核对一个难唱的乐句,就把播放速度放慢,音高不会跟着变。谱子改到你满意,就导出 PDF 放到谱架上,或者导出 MusicXML,在 MuseScore、Sibelius 或 Dorico 里接着编辑。如果你手里只是手机上随手录的一段,还不是正式录好的版本,可以看我们讲把语音备忘录变成乐谱的那篇,专门讲的就是这种情况。
修掉不准的地方
知道常见错误出在哪,检查起来就快,因为你查的是几样具体的东西,不用从头到尾干读一遍:
- 滑进音和滑音。 你从下往上滑进一个音的地方,模型可能把中间经过的音高也写出来。把它们合成你本来想唱的那一个音。
- 拖腔。 一个音节上的一串音,扒回来时节奏可能被硬凑成了整齐的时值。听一遍,把时值理顺。
- 八度跳错。 人声落在某些音区时,模型可能把一两个音放错八度。很好发现,挪一下就行。
- 换气被当成休止符。 通常没问题,偶尔一次换气会变成一个别扭的休止符,顺手清理掉。
好乐手检查任何自动扒出来的谱,都是这个习惯。我们在修正 AI 扒谱错误那篇里讲得更细。从一张白纸到一份扎实的草稿,工具两分钟就能帮你走完。省下来的时间可以花在音乐上的取舍上,不用再坐在琴前一个一个地试音高。
常见问题
AI 能把人声录音变成乐谱吗?
旋律部分可以。AI 扒谱会听一段唱出来或哼出来的旋律,把音高和节奏写成你能看、能改的乐谱。一条唱得清楚的单旋律效果最好,一两分钟就能在五线谱上拿到旋律。人声模型比钢琴模型新,所以把结果当成一份扎实的初稿,自己再检查一遍,尤其是从下往上滑进去的音、滑音和转音。
扒出来的谱里有歌词吗?
没有。扒谱记下的是人声旋律的音符和节奏,歌词不在里面。想让歌词出现在谱表下方,可以在编辑器里自己加,也可以导出后在打谱软件里加。旋律、调和节奏是从录音里扒出来的,歌词不是。
怎样让人声扒谱尽量准?
单独录人声,离麦克风近一点,房间尽量干,一个音就清清楚楚唱一个音,别在音高之间滑来滑去。速度稳,节奏就更容易扒准。如果人声混在一整首歌里,先把它分离出来。然后对照录音检查草稿,把滑进音或拖腔让模型搞混的地方改掉。
