|
|
在司法机关办案的流程中,一段录音、一段影片往往或许成为认定案件事实的关键证据。随着生成式人工智能科技迅速发展,声音、人脸影片等正在成为最简易被伪造的数字素材之一。从冒充亲友实施诈骗,到伪造录音、影片干扰纠纷处理,越来越逼真的语音和影像正在挑战大众对证据真实性的判断。如何发掘隐藏在声音、影片背后的伪造痕迹?跟随记者镜头,走进司法鉴定科学研究院去看一看。
司法鉴定人向记者展示了一段三人影片会议片段,其中有局部人脸是人工智能换脸生成的。
根据记者所发掘的影片异常点,是否可以判断影片中张三和李四是经过换脸的?
司法鉴定科学研究院司法鉴定人 曾锦华:现实上张三是没有换脸的,是真实的人脸,他当时录制的画面品质没有其他两个清晰,因此第一眼让人认为有点假。由于他的图像品质是最差的,或者说他的前景和背景反差是不高,因此让人认为他是换脸。我们细微分析的时候会发掘,张三的面部图像轮廓和背景轮廓偶尔候会融合在共同。
在鉴定人逐帧慢速观察下,看似完美的换脸影片,还是露出了破绽。
司法鉴定科学研究院司法鉴定人 曾锦华:假如逐帧分析的话,会发掘正常人的眨眼动作肯定是有一个完整闭合,再睁开的流程。李四、王五在这个影片中,他们的闭眼是不完整的。因此说这也是一些多模态大模型固有的一些缺陷或者破绽。这个也是要逐帧分析,不逐帧分析的话是没法判断出来的。比如说,这个牙丢了一块,她的头发会消失掉则一点点。
移花接木天衣无缝?
声纹频谱辨真伪
看上去没什么破绽的李四和王五竟然是AI合成,而给人感觉“一眼假”的张三反而是实拍影像。接下来司法鉴定人又向记者展示了一段貌似完整连贯,实则经过拼接的录音。
鉴定人告诉记者,录音鉴定科技通常包括听觉识别和频谱分析。听觉识别核心靠鉴定人的经历,逐字逐句记录每一句话每一个停顿,将说话人的发音、声调、咬字习惯、语句连贯性、口头禅等细节逐一识别。
司法鉴定科学研究院司法鉴定人 耿浦洋:很显著一听,从听觉上后半句是来自于另一个设备。
除了听觉识别的判断外,鉴定人还需求对声纹频谱,也就是语音信号的频率—能量分布图进行科学分析,找出隐藏在其中的破绽。
司法鉴定科学研究院司法鉴定人 耿浦洋:后面紫色这种像乱纹一样的东西,现实上是一个设备本底噪声。哪怕在完全安静的情况下,它也会保留这些特征,差异的设备有差异的本底噪声。这个设备对于本底噪声处理,在六、七千赫兹,它是有大量的黑色块,然而后面这一局部它对于六、七千赫兹,黑的局部就没有这么多,说明是来自于差异的本底噪声。这就是我们检验中发掘一个比较显著,从另一个设备录音,然后剪切插进来。
除了句子的拼接外,在司法鉴定中,还常常遇到一些录音将短短的两三个关键字插入,从而转变了说话人原来表达的意思。
司法鉴定科学研究院司法鉴定人 耿浦洋:虽然一个人说话是具有很强的稳定性,然而在自然界不或许出现一模一样的频谱。由于找到这个发音人,让他说10遍100遍“这么多”,每一次的这么多,即使整个趋势声纹是符合的,然而不或许像这种是一模一样的。这里出现了就说明是复制粘贴的。
伪造手段不断升级
辨伪鉴真皆须准确
随着AI伪造科技持续迭代,鉴伪手段也在不断更新。面对新科技新情况,司法鉴定如何才能保证客观公信力?
司法鉴定人表示,人工智能科技升级迭代步伐不断加快,也在倒逼司法鉴定行业不断保持科技识别的敏锐度。
司法鉴定科学研究院司法鉴定人 曾锦华:给予的伪造影片素材,或许经过了网络传输,导致它的品质下降,或者是经过别的反取证反鉴定形式,大量的伪造痕迹就会消失。我们能证明一个东西是假的,是比较简易的,然而想证明一个东西是真的比较难。我们必须把市面上所有的专业科技工具全部用过一遍,没有发掘它还有造假的痕迹,在这种情况下,我们可以说,未发掘这个东西是经过AI合成或者剪辑的。
(总台央视记者 李可婧 梁治) |
免责声明:本文由网友发表或转载,不代表大泸州的观点和立场,不对其真实合法性负责.如有异议或侵权,请与本网站联系删除!
|