摘要
本发明公开了一种整合感觉与知觉线索的谓词相似性判别方法,具体步骤如下:目标检测过程提取出输入图像的外观特征、空间特征及实体标签,并组合目标对构造联合特征。然后感觉敏感模块负责捕捉图像中的直觉性视觉线索作为感觉线索,聚合实体级视觉信息,实现对候选实体对的粗粒度筛选和特征对齐。知觉增强模块在感觉模块输出的基础上,进一步建模实体对间的深层关系,通过语义映射与判别性学习实现对相似谓词的语义区分和优化以归纳知觉线索。最后区分过后的三元组类别在知觉增强模块中的认知判别层对同一区域的统一关系的视觉场景进行深度联想,确保实体对之间嵌入的谓词在不影响语义的前提下能够捕获发现的细粒度语义。