摘要
本发明公开了一种基于无监督数据生成精标数据的方法及系统,涉及文本处理以及语音识别技术领域,包括:获取短句,对短句进行质量筛选,得到高音频质量的短句;对高音频质量的短句进行说话人分类筛选,得到筛选后的单人说话短句,对单人说话短句施加随机噪声得到噪声短句;对单人说话短句和噪声短句使用语音识别工具进行识别,得到短句的对应文本以及噪声短句的对应文本;分别将单人说话短句和短句的对应文本,以及噪声短句和噪声短句的对应文本使用force‑alignment技术进行强制对齐,并获取对齐的置信度,得到筛选依据1和筛选依据2;接收音频,基于筛选依据1和筛选依据2对音频进行筛选,得到置信度高的音频。