摘要
本发明公开了一种基于显著性图结构增强的多模态影像匹配方法与系统,属于图像处理领域。首先,本发明创新性地构建了像素级显著性置信度图,用以度量各区域的匹配潜力,通过该图引导注意力机制在图结构中动态聚焦于关键区域;其次,融合多尺度结构特征与语义分割信息,增强特征表达的语义感知能力;最后,构建图像内结构图与图像间语义引导图两类异构图结构,通过引入显著性调制的自注意力和交叉注意力机制,实现在图结构上进行的全局‑局部信息增强与跨模态语义对齐,从而显著提升匹配的精度与稳定性,实现多模态影像的半密集匹配。