摘要
本发明公开了一种基于时频特征联合建模的语音增强方法及系统,涉及语音增强技术领域,包括:获取待增强的失真语音信号;对失真语音信号进行短时傅里叶变换,得到幅度谱和相位谱,并从中提取时频特征;通过编码器对时频特征进行编码,以提高语义维度和时间感受野,生成编码时频特征;将编码时频特征输入至时频建模模块中,依次对时间维度与频率维度进行特征建模,以捕获语音信号中的时间动态信息与频率结构依赖,生成时频联合建模特征;将时频联合建模特征分别输入至并行的幅度解码器和相位解码器中,输出预测的干净语音幅度谱和相位谱,再通过反短时傅里叶变换还原为增强语音波形。本发明可重构出质量更优的增强的语音信号。