摘要
本发明公开一种多媒体的远程AI控制方法及装置、计算机可读存储介质,属于多媒体设备控制技术领域。控制方法包括:获取麦克风阵列采集的声音信号和多媒体设备的音频输出信号;分别提取声音信号和音频输出信号的特征;将提取的特征输入深度学习模型,得到分类结果,分类结果包括环境声音或多媒体设备自身输出声音;将提取的特征和分类结果发送至云计算控制系统,并根据云计算控制系统的第一反馈指令控制多媒体设备的播放,其中,第一反馈指令由云计算控制系统基于AI模型分析所接收的特征和分类结果而得到。所述方法可解决相关技术中存在的无法有效区分音响自身输出声音和环境声音,控制准确性低问题。