摘要
本申请涉及人工智能领域,具体提供一种基于多模态大模型的模型评估方法、系统、设备及介质,旨在解决现有技术对模型评估时所产生的时间成本和人力成本较高的问题。为此目的,本申请的基于多模态大模型的模型评估方法,包括:获取视频数据;基于所述视频数据和已训练的多模态大模型,确定预标注数据;基于所述视频数据和待评估的行为识别模型,确定行为识别结果;基于所述预标注数据和所述行为识别结果,对所述行为识别模型进行精度评估。本申请通过多模态大模型对测试的视频数据进行深度分析和自动化预标注,显著降低了模型精度评估所需的人力成本和时间消耗,实现行为识别模型的快速效果验证和落地。