国内刊号:51-1307/TP
国际刊号:1001-9081
发布日期:
作者:刘伟波, 曾庆宁, 卜玉婷, 郑展恒
单位:桂林电子科技大学 信息与通信学院, 广西 桂林 541004
关键词:语音识别,双微阵列,卷积神经网络,噪声环境,稳健性
基金:国家自然科学基金资助项目(61461011);广西自然科学基金重点项目(2016GXNSFDA380018);"认知无线电与信息处理"教育部重点实验室主任基金资助项目(CRKL160107,CRKL170108)。
为解决噪声环境下语音识别率降低以及传统波束形成算法难以处理空间噪声的问题,基于双微阵列结构提出了一种改进的最小方差无畸变响应(MVDR)波束形成方法。首先,采用对角加载提高双微阵列增益,并利用递归矩阵求逆降低计算复杂度;然后,通过后置调制域谱减法对语音作进一步处理,解决了一般谱减法容易产生音乐噪声的问题,有效减小了语音畸变,获得了良好的噪声抑制效果;最后,采用卷积神经网络(CNN)进行语音模型的训练,提取语音深层次的特征,有效地解决了语音信号多样性问题。实验结果表明,提出的方法在经CNN训练的语音识别系统模型中取得了较好的识别效果,在信噪比为10 dB的F16噪声环境下的语音识别率达到了92.3%,具有良好的稳健性。
来源:2019年第11期
《计算机应用》期刊编辑部