摘要
本发明公开了一种基于图像点云融合的语义分割方法及系统,该方法包括:利用RGB‑D相机获取目标场景同一时刻的RGB图和深度图,利用预设模型对RGB图进行语义分割,对目标点云进行处理得到体素级特征和点级几何特征,通过注意力融合机制ASFFN实现不同模态间的深层特征交互,通过引入LMA与LVA模块实现跨模态特征的对齐与深度融合,显著降低了由校准误差带来的性能退化风险。本发明解决了当前医疗器械精密零部件检测过程中,因单一感知模态能力受限、多模态融合深度不足以及跨模态误差敏感性高所导致的不准确和不稳定的问题。