《潜伏》里余则成伪造的那段录音在当时可以鉴别真伪吗?
先说结论,不能。
首先排除余则成拿出来的录音带是所谓物理剪辑的一段一段靠透明胶粘起来的录音带。一来拿这么个玩意儿到站长面前放,是觉得站长老眼昏花看不见胶带么?二来当时用的那种录音机,驱动马达的扭矩是很大的,粘起来的带子根本禁不住扯就直接断了。
所以老余拿出来的带子,就是在机器上翻录剪辑的,这有个专业名词叫线性编辑。
这东西鉴定是否拼接,最核心的指标就是看背景噪音的特征是否相符,如果是双声道以上的,还可以根据声音相位、反射波特征等等来进行分辨。
比方说,一个人的背噪里有风声,另一个没有。比方说,一个声音回音延迟2ms,另一个5ms。
诸如此类等等都可以判断伪造。
但是,在当时的技术和设备条件下,不行。
首先是当时除了特殊应用场合,是没有多声道录音的。不管是监听用的台式机还是随身用的间谍机,都是单声道的。所以所有的基于声道波形差异特征的鉴别手段统统都没用了——当时也没有可以做波形分析的技术和设备。
其次,当时的监听用录音机和间谍机,为了清晰的捕捉到主要构成情报要素的人的语音的频段,在麦克风选择和滤波处理上,是会把高低频都给扔掉的。而背景音的绝大部分可分辨特征其实都在这部分里。因为和人声同频的部分会被淹没在人声里。
加上这种磁带机或钢丝机都有个无法避免的问题,就是因为马达转速不均匀造成的声音变形。这个只能减弱无法彻底消除,而且每次的变形都是随机的。相当于又加进去了一组干扰信号。
所以,只要剪辑之后,转录两边以上,以当时的技术水平和设备,地球上就没有人可以鉴定出真伪来。
基本上伪造录音和鉴别伪造录音,斗争的高峰期要到七十年代后期了。到八十年代初,这方面的技术体系,理论就都非常成熟了。再往后就是新工具新设备的进步,思路和方法其实都还是那么回事。直到算力水平发展到我们可以基本解析一个人的声纹模型之后,才有进入了一个新的领域。
