摘要
本说明书实施例公开了一种针对用于健康告知的大语言模型进行训练的方法。该方案可以包括:获取初始训练数据;初始训练数据包括样本数据和针对样本数据的标签数据;样本数据包括用户输入样本和第一健康告知文本;根据关联关系数据,生成针对用户输入样本的知识扩展信息;关联关系数据为用于反映从预设文本以及预设文本所属领域的基础知识中提取的多条数据之间的关联关系;预设文本至少包括第一健康告知文本;基于初始训练数据和知识扩展信息,生成训练样本数据;利用训练样本数据对预训练的大模型进行监督微调训练,得到用于健康告知的大语言模型。