摘要
本申请涉及数据处理技术领域,尤其涉及一种用于语音识别的人机交互方法及系统。方法包括:对目标时间段内的音频数据进行短时傅里叶变换获得频谱图,并对频谱图进行灰度化处理获得灰度图像;从灰度图像中筛选出多个目标横向区域;利用预设滑动窗口在灰度图像中滑动,从灰度图像的时间段中确定目标时域区间;从灰度图像中确定频率值位于预定基频范围内的初始频谱区域,并根据初始频谱区域、目标时域区间以及多个目标横向区域,确定人声所在的目标频谱区域,以根据目标频谱区域进行人机交互。通过以上技术方案,能够保证用户与电子设备进行语音交互的效率。