摘要
本申请提供了一种语音识别优化方法、装置、介质和系统,该方法包括:提取第一语音指令的第一语音特征并确定信号噪声比,并调整预设的语音活性检测阈值;获取第二语音指令,在第二语音指令的音频能量值大于或等于调整后的语音活性检测阈值的情况下,执行确定步骤;在第二语音指令的音频能量值小于调整后的语音活性检测阈值,且第二语音指令的第二语音特征与第一语音特征的相似度大于或等于第一预设阈值的情况下,执行确定步骤;确定步骤,确定第一语音指令以及第二语音指令为待解析音频。本申请解决了现有的方案无法有效区分用户发出的指令与周围人的闲聊,导致在多人环境中容易误识别周围人的声音为指令,导致语音识别的准确性较低的问题。