摘要
本申请公开了一种视频时序定位方法、装置、设备、存储介质及程序产品,涉及视频处理技术、人工智能技术、大模型技术、大语言模型技术领域,该方法包括:获取第一视频以及第一提示信息,第一提示信息用于表征针对第一视频的第一视频时序定位任务,基于第一提示信息以及第一策略模型对第一视频进行处理得到第一视频时序定位任务的处理结果,第一策略模型是基于第一样本数据对第二策略模型进行优化后得到,优化的过程被配置为基于第二策略模型的预测结果以及第一样本数据的目标结果进行奖励值计算,并基于修正后的奖励值对第二策略模型进行优化。该方法能够提升第一策略模型在时序视频任务中的性能。