摘要
本申请公开了一种基于大模型的多数据源智能问答方法、设备及存储介质,涉及数据处理技术领域,该方法包括:将用户上传的初始数据集对应的元数据,以及用户提问输入至预训练的推理大模型,生成查询代码;根据查询代码对元数据进行筛选查询,得到目标数据集;将目标数据集和用户提问输入推理大模型,生成数据分析代码;执行数据分析代码,得到代码执行结果。元数据统一的符号化结构为模型生成查询代码提供了引用的约束依据,使模型能精准理解数据的格式规范与内在关联,基于推理大模型将自然语言提问映射为符合数据存储格式的查询语法,通过元数据提示和代码生成,规避了大模型对异构数据格式和元数据规则适配不足的问题。