摘要
本申请公开了一种单通道语音转录方法及装置、电子设备、存储介质,所述方法包括:采集单通道的当前原始混合语音信号,并对其进行时频域预处理,得到当前原始混合语音信号的幅度谱和相位谱;通过矩阵分解模型对幅度谱进行非负矩阵分解后,利用分解结果计算时频掩码,并利用时频掩码与该幅度谱进行信号重建,输出多个当前分离语音幅度谱;其中,通过将矩阵分解模型和神经网络模型联合优化训练;利用当前原始混合语音信号的相位谱,对各个当前分离语音幅度谱进行转化,得到各个当前分离语音;通过语音转录模型对各个当前分离语音进行语音识别和敏感词分类,并将语音识别文本与敏感词分类结果融合后,输出屏蔽敏感词的各个当前分离语音的转录文本。