贴一下原曲链接和翻唱链接:
录制前我们向原p主マサラダ询问过原曲中小孩声的制作方式。他的做法很直接,使用了一些 repitch类算法/插件,把正常音高的vocal直接整体提升一个八度。Melodyne这样的工具可以做到这一点,当把人声整体拉高八度时,formant会同步上移,声音自然变尖,听起来会有童声感。在vocaloid音源上,这种方法容易成立,因为音源本身已经是合成声,频谱结构比较干净稳定。
但在真实录制的人声上,这种硬拉八度的方法问题暴露得比较明显。尤其是+12 semitone这种极端处理,算法需要对频谱进行很大幅度的重构,带来明显的音质劣化,产生电流感和颗粒感,失真非常明显。
改进思路
我希望翻唱版本中这个高八度声部的音质更干净,同时formant更可控。我觉得更理想的思路其实是先改变时间,再恢复速度。
具体做法:
- 以原曲0.5倍速播放伴奏
- 歌手按原key演唱
- 录制完成后,将人声加速回原速度
这样处理后vocal音高会自然提升一个八度,formant也会随之变尖,形成小孩子声。这种方法在理论上不会产生直接pitch shift带来的问题。
但传统的time stretch算法在做这种2x加速后,咬字的可懂度不太够。尤其在元音区域,很容易听不清在唱什么。相比传统算法,Elastique系列的算法在时间拉伸与频谱重建上做得更细致一些。在Bitwig中使用Elastique Pro算法时可以进一步调整grain size和formant。更容易把最终结果调整到自己舒服的范围(Reaper里也有elastique算法,但是我暂时没看到formant的细致调整在哪做)。
放一个Elastique Pro算法在Bitwig里的formant调整试听,应该比较容易get到formant带来的差异在哪(视频加载可能有问题…有时会需要一些科学上网):
(左下角也可以看到这段干声的原tempo是71.5BPM,是原曲143BPM的一半)