摘要
本发明公开了面向康养领域的大模型对话生成方法及系统,属于人工智能技术领域,要解决的技术问题为对于康养领域、如何基于人工智能生成逼真的虚拟数字人。包括如下步骤:采集对话双方的语音得到音频数据,将音频数据转换为文本数据并将文本数据整理为对话格式;将对话格式的文本文档分解为多个数据块,对于用户输入的查询信息,基于数据块、通过RAG模型生成与查询信息匹配的应答文本;对于与查询信息匹配的应答文本,通过声音克隆技术GPT‑SoVITS生成与原始说话者声音逼真的语音,并将语音导出得到音频文件;基于原始说话者的人脸图像以及音频文件、通过3D混合模型生成说话人脸视频。