摘要
本申请公开了一种模型训练方法、装置、介质及设备,包括:获取样本视频的视频帧序列数据,样本视频为真实驾驶场景对应的视频;将视频帧序列数据输入至初始扩散模型进行视频生成处理,得到目标视频帧序列数据;基于视频帧序列数据进行运动预测处理,得到物体预测结果,物体预测结果指示样本视频中至少一个物体的运动预测过程;基于视频帧序列数据和目标视频帧序列数据确定噪声预测损失数据;基于物体预测结果和目标视频帧序列数据确定物理一致性损失数据;基于噪声预测损失数据和物理一致性损失数据,对初始扩散模型进行训练得到目标扩散模型,目标扩散模型用于生成针对智能驾驶的视频训练数据。本申请可以提升所生成的视频训练数据的准确性。