一种基于大语言模型的软件缺陷预测数据集的构建方法及装置

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
一种基于大语言模型的软件缺陷预测数据集的构建方法及装置
申请号:CN202511018073
申请日期:2025-07-23
公开号:CN121009366A
公开日期:2025-11-25
类型:发明专利
摘要
本发明涉及软件技术领域,具体涉及一种基于大语言模型的软件缺陷预测数据集的构建方法及装置,该方法包括获取软件缺陷预测数据集,选取多个大语言模型分别对同一所述软件缺陷预测数据集从不同批注维度进行批注,得到多个批注结果;选取投票模型对所述批注结果进行评估,以筛选出每一批注维度下的目标大语言模型,所述目标大语言模型相较于其他大语言模型在对应批注维度的批注效果更优;将每一批注维度下的所述目标大语言模型构建成模型池,所述模型池用于构建后续软件缺陷预测数据集;从目标大语言模型中选取一比较大语言模型,并将比较大语言模型对应的某一批注维度下的数据,与从模型池中选取的抽样数据进行对比,以验证模型池中数据质量。
技术关键词
软件缺陷预测 大语言模型 数据 主流编程语言 模块 条目