摘要
本申请涉及数据处理技术领域,具体涉及一种基于大模型平台的数据查询方法及系统。该方法包括:根据查询内容,获取查询内容的相关文件候选集;获取查询词汇之间的内在关联度,进而对查询词汇进行第一次聚类,获取第一次聚类的最大聚类簇的查询领域代表性;将候选文件词汇加入查询词汇进行第二次聚类,获取第二次聚类后的最大聚类簇的查询领域代表性的偏移度,根据查询领域代表性的偏移度,获取候选文件的查询意图匹配度;根据查询意图匹配度,获取候选文件的查询匹配优先级;根据查询匹配优先级,获取相关文件候选集的候选文件排序结果。通过分析确认查询内容所属领域,对检索结果进行优化排序,确保查询结果能够准确反映用户真实需求。