摘要
本说明书实施例公开了一种策略生成模型训练及策略生成方法、装置以及终端,根据专业经验对样本风险监管语料添加风险知识标注,得到标准训练语料;基于至少一种基础大模型构建至少一个策略生成模型,将标准训练语料输入各策略生成模型,对各策略生成模型进行训练;在各策略生成模型的训练过程中,控制各策略生成模型针对标准训练语料输出多个风控策略,并根据多个风控策略和风险知识标注调整各策略生成模型的参数,直至各策略生成模型收敛。通过基于专业经验标注的训练语料,对基于基础大模型构建的策略生成模型进行训练,使得策略生成模型能够学习专业的知识和经验并用于生成策略,大模型所具备的自学习能力提高了策略生成的准确性和鲁棒性。