摘要
本说明书实施例公开了一种基于知识高维向量的文档分析方法、装置、设备及介质,涉及信息检索技术领域,用于解决现有检索精度低效率低的问题。方法包括:基于预置预置解析引擎与预置动态切片策略对多格式文档进行处理,获得多格式文档分片;对多格式文档分片进行向量编码,获得多格式文档分片的当前语义向量与当前位置向量;根据多格式文档所对应的基本结构特征对预置向量数据库进行筛选,确定多格式文档所对应的分析范围;将当前语义向量与当前位置向量,分别与分析范围内各历史文档的切片语义向量与切片位置向量进行相似度判别,获得多格式文档的原创性分析结果;基于预置分析模型对原创性分析结果进行处理以获得多格式文档的结构化分析结果。