摘要
本发明涉及人工智能与智能审计技术领域,公开了基于多模态大模型的智能审计方法,包括以下步骤:包括:S1、图像预处理;S2、基于多模态大模型进行深度特征提取;S3、动态调整OCR识别参数;S4、通过语义理解模块对OCR识别结果进行上下文分析;S5、采用数据增强技术,扩展训练数据集;S6、利用并行计算和硬件加速技术;S7、将OCR识别结果转化为结构化数据格式。本发明通过采用基于图文融合建模与分层语义解析的技术方案,达到了多模态文档信息的统一识别与结构理解的技术效果,相较于现有技术中图像与文本处理分离导致语义错位与上下文脱节的技术方案,解决了异构模态信息融合度低、上下文推理能力弱的问题。