摘要
本申请公开了基于多智能体的视觉问题处理方法、装置、设备及介质,涉及计算机视觉技术领域,包括:获取目标样本图像和目标样本图像对应的视觉问题描述,利用视觉理解智能体对目标样本图像进行分析,以获取相应的视觉分析报告;基于视觉分析报告生成视觉问题描述对应的问题处理框架;利用知识检索智能体在预设知识库中检索目标样本图像对应的目标数据,并基于目标数据和问题处理框架生成视觉问题描述对应的目标解决方案。通过利用知识检索智能体在知识库中多源检索视觉问题对应的解决方案、技术报告及代码数据,并基于问题处理框架整合生成目标解决方案,同步解决了专家知识依赖以及技术方案与可执行代码分离的问题。