梅铁民
(沈阳理工大学自动化与电气工程学院,辽宁沈阳 110159)
人对房间混响效应的感受效果与声源信号本身密切相关。众所周知,在报告厅、教室等场所,混响效应使声音听起来有一种遥远感,降低了语音可懂度,是影响语音感知质量的重要因素之一。如何有效地消除或抑制语音信号中的混响效应,对提高语音信号感知质量或语音识别率均有着重要意义,去混响也是高性能免提电话、电视电话会议系统、助听器、人机对话系统、音频监听监录系统、立体声影院、立体声汽车音响系统、多媒体等应用中的关键技术,具有广泛的应用前景[1-3]。
在房间内,混响效应由房间内声音反射面对说话人语音的多次反复反射引起。麦克风或人耳接收到的信号是声源(说话人)信号与房间内各个方向反射回来的信号的叠加,数学上表现为声源信号与房间内冲激响应的卷积。因此,语音信号去混响过程本质上是信号的解卷积过程。由于语音信号功率谱的非白性,适用于通信信道自适应均衡的一些传统方法如Bussgang算法等并不适用于语音信号的去混响[4]。
最早用于语音信号去混响的方法是基于单麦克风系统(Single input single output, SISO)的复倒谱解卷积[5]。在复倒谱域内,上述卷积关系转化为线性叠加关系,并且声源信号集中于复倒谱的低时部分,而冲激响应则集中于高时部分,故可以用低时窗滤波来消除混响。但是,由于声源信号和房间冲激响应在复倒谱域内有一定重叠,因此这种方法去混响效果并不理想。……