1.一种针对特色合成的伪造音频鉴伪方法,其特征在于,具体步骤包括:
步骤S1,对待鉴定音频进行预处理,获取待鉴定音频中的人声音频数据、环境音频数据和待鉴定音频人声的真实年龄信息;
步骤S2,建立音质比对模型,对所述人声音频数据、环境音频数据进行分析生成第一比对数值、第二比对数值,包括:将待鉴定音频分为m个检测区间,其中m为大于1的整数,分别获取m个检测区间内的人声信噪比PS、人声失真率PD和人声频率范围PF,通过公式化进行分析得出第m个检测区间的人声音质系数a(m),将第m检测区间的人声音质系数a(m)减去所有检测区间人声音质系数均值 并进行平方计算,再除以检测区间数m,计算得出第一比对数值P;
分别获取m个检测区间内的环境信噪比ES、环境失真率ED和环境频率范围EF,通过公式化进行分析得出第m个检测区间的环境音质系数β(m),将第m检测区间的环境音质系数β(m)减去所有检测区间环境音质系数均值 并进行平方计算,再除以检测区间数m,计算得出第二比对数值Q并对第一比对数值、第二比对数值进行归类处理,生成音质差异标识;
步骤S3,建立人声匹配模型,对所述人声音频数据进行分析与匹配,生成匹配年龄信息;
步骤S4,对匹配年龄信息与真实年龄信息进行分析处理,生成音频年龄匹配标识;
步骤S5,构建数据关联输出模型,对音质差异标识和音频年龄匹配标识进行整合处理,生成伪造音频目标、可疑音频目标和真实音频目标。
2.根据权利要求1所述的一种针对特色合成的伪造音频鉴伪方法,其特征在于,所述人声音频数据包括人声信噪比PS、人声失真率PD和人声频率范围PF;
所述环境音频数据包括环境信噪比ES、环境失真率ED和环境频率范围EF。
3.根据权利要求2所述的一种针对特色合成的伪造音频鉴伪方法,其特征在于,所述音质差异标识包括音质高差标识、音质中差标识和音质低差标识,所述音质差异标识的生成逻辑为:将第一比对数值P与第二比对数值Q,进行数值比对,求出音质差异系数γ,设置音质差异系数比对阈值CH1和CH2,其中0<CH1<CH2,将音质差异系数γ代入音质差异系数比对阈值CH1和CH2中进行比较分析,当待鉴定音频的音质差异系数γ小于CH1时,将该待鉴定音频标记为音质低差标识;当待鉴定音频的音质差异系数γ小于CH2且待鉴定音频的音质差异系数γ大于CH1时,将该待鉴定音频标记为音质中差标识;当待鉴定音频的音质差异系数γ大于CH2时,将该待鉴定音频标记为音质高差标识。
4.根据权利要求3所述的一种针对特色合成的伪造音频鉴伪方法,其特征在于,所述人声匹配模型的构建步骤为:对包含不同年龄段的音频数据进行收集,具体收集年龄1~70岁成员的音调数据a、共振频率f和声音的清晰度k、并将收集到的数据与其对应的年龄进行匹配,从而生成以年龄为序列的数据集,为确保数据集的平衡性,每个年龄数据集均需采集足够的样本进行均值求解方可录入人生匹配模型中,在人声数据录入后,训练集用于人声匹配模型的训练和参数调整,测试集用于评估模型的性能和准确度,使用测试集对训练好的模型进行评估,计算分类准确度、精确度和匹配效率等指标来衡量模型的性能,训练好的人声匹配模型模型即为构建完成。
5.根据权利要求4所述的一种针对特色合成的伪造音频鉴伪方法,其特征在于,所述人声匹配模型的构建的匹配逻辑为:具体的,将年龄为数据集序列可分为n个数据集,n= ,将采取的样本音
调数据a、样本共振频率f和样本声音清晰度k进行权重分析处理,生成判定标准系数 ;
3
其中判定标准系数 =(r1a+r2f+r3k)/6.1285,r1、r2、r3分别表示生成判定标准系数 中音调数据a、样本共振频率f、样本声音清晰度k的权重占比,r1、r2、r3大于0,且r1+r2+r3=
0.675,设此时判定标准系数 的匹配年龄信息为W。
6.根据权利要求5所述的一种针对特色合成的伪造音频鉴伪方法,其特征在于,所述音频年龄匹配标识包括不符标识、误差标识和相符标识,生成音频年龄匹配标识的逻辑为:所述人声音频数据还包括人声音调数据a1、人声共振频率f1和人声清晰度k1;
通过人声匹配模型将声音调数据a1、人声共振频率f1和人声清晰度k1代入判定标准系数 公式中进行分析,生成检测判定系数 1:3
即 1=(r1a1+r2f1+r3k)1 /6.1285;
此时检测判定系数 1的匹配年龄信息为W1,设获取的待鉴定音频人声的真实年龄信息为W2,对匹配年龄信息W1和真实年龄信息W2进行公式化分析:W差= lW2-W1l-g;
其中为匹配年龄偏差,W差≥0,g为年龄误差修正常数,0<g≤3;
设置年龄偏差阈值Wh1和Wh2,其中,Wh2>Wh1≥0,将匹配年龄偏差W差代入年龄偏差阈值Wh1和Wh2中,当待鉴定音频人声的匹配年龄偏差W差小于年龄偏差阈值Wh1时,将待检测音频标记为相符标识;当待鉴定音频人声的匹配年龄偏差W差大于年龄偏差阈值Wh1且匹配年龄偏差W差小于年龄偏差阈值Wh2时,将待检测音频标记为误差标识;当待鉴定音频人声的匹配年龄偏差W差大于年龄偏差阈值Wh2时,将待检测音频标记为不符标识。
7.根据权利要求6所述的一种针对特色合成的伪造音频鉴伪方法,其特征在于,对音质差异标识和音频年龄匹配标识进行整合处理,生成伪造音频目标、可疑音频目标和真实音频目标的逻辑为:当待鉴定音频内同时拥有相符标识和音质低差标识、相符标识和音质中差标识或误差标识和音质低差标识时,将该待鉴定音频标记为真实音频目标;
当待鉴定音频内同时拥有误差标识和音质中差标识、相符标识和音质高差标识或不符标识和音质低差标识时,将该待鉴定音频标记为可疑音频目标;
当待鉴定音频内同时拥有不符标识和音质高差标识、不符标识和音质中差标识或误差 标识和音质高差标识时,将该待鉴定音频标记为伪造音频目标。