利索能及
我要发布
收藏
专利号: 2017107313439
申请人: 南京邮电大学
专利类型:发明专利
专利状态:已下证
更新日期:2026-08-04
缴费截止日期: 暂无
联系人

摘要:

权利要求书:

1.一种基于卷积神经网络CNN的声源定位算法,其特征在于,包括以下步骤:步骤1:利用Roomsim工具包模拟出在带有混响和噪声的室内环境,根据两个麦克风接收到的信号x1(t)和x2(t),计算出麦克风接收信号的互相关函数 再进行分帧截取及特征提取,得到训练集,为下一步的模型训练做准备。

步骤2:将互相关函数特征作为输入,按照一维CNN进行模型训练,训练过程中,激活函数采用ReLU函数,其数学表达式为:f(x)=max(0,x)  (1.12)

步骤3:计算出CNN模型参数后,即完成模型训练后,利用和生产训练数据一样的方法得到测试数据Y',将其输入CNN模型后,利用贝叶斯决策来构建判决式决定测试样本的类别,即利用高斯概率模型对类条件概率密度P(z|Ck)建模,然后根据贝叶斯决策最大化正确分类率:其中Rk表示决策域,即在决策域Rk内的样本都属于Ck类,此时只需要根据贝叶斯定理p(z,Ck)=p(Ck|z)p(z),而p(z)对于所有项是相同的,所以只要找出后验概率p(Ck|z)最大的类别即为样本z所属的类别,即声源的方位。

2.根据权利要求书1所述的一种基于卷积神经网络CNN的声源定位算法,其特征在于,步骤1所述的特征提取的具体步骤如下:步骤1.1:声源位于训练位置rs,s=1,2,...,k,麦克风阵记录下声源在该位置处发出的信号s(t);

步骤1.2:根据房间脉冲响应和声源信号计算得到麦克风接收到的混响信号x1(t)和x2(t);

步骤1.3:根据麦克风接收到的混响信号x1(t)和x2(t),经过预处理后,计算相位变换加权广义互相关函数步骤1.4:对 进行分帧截取,得到训练集Y。