摘要
本申请提供了一种空间定位方法、装置、设备及存储介质,该方法先基于目标场景的三维点云数据和多视角离散图像构建神经辐射场;再获取用户行为数据,包括用户拍摄的基础位姿图像和/或编辑虚拟物体时的编辑数据,从中提取有效位姿并生成虚拟拍摄位姿集;通过神经辐射场生成绑定位姿的渲染图像集;最后接收定位请求,结合待定位图像、渲染图像集及三维点云数据确定目标位姿。本申请结合多模态数据确定目标位姿,突破了单模态传感器在复杂场景的精度局限,消除了视觉匹配累积误差与动态环境干扰,在提升定位精度的同时降低了计算资源消耗,同时结合用户行为数据提取有效位姿进行渲染,避免了冗余渲染导致的计算复杂或不准确的问题。