摘要
本申请实施例提供了一种基于语音的情绪识别方法和装置、电子设备及存储介质,属于人工智能技术领域,适用于金融科技领域和医疗科技领域。该方法包括:获取目标语音识别模型;目标语音识别模型包括目标音频编码子模型、目标音频解码子模型、目标说话人识别子模型;对目标语音数据进行特征提取,得到目标语音特征;通过目标音频编码子模型对目标语音特征进行音频编码,得到目标音频编码数据;通过目标音频解码子模型对目标音频编码数据进行文本解析,得到目标语音文本信息;通过目标说话人识别子模型对情绪性别编码嵌入、目标音频编码数据和目标语音文本信息进行双重交叉注意力计算,得到目标说话人情绪信息,能够提高语音情绪识别的准确性。