摘要
本发明公开了基于多模态特征的视频多模态内容管理系统及方法,涉及视频多模态内容管理技术领域,包括分析文本内容中不同文本句子之间的相似程度,对文本内容中的文本句子进行合并;对特征文本段落进行特征提取,并构建特征文本段落的文本向量,分析参考文本段落对特征文本段落的参考价值,得到目标参考文本段落,得到参考文本集;分析多模态特征数据中不同行为指标对数字人播报特征文本段落的播报影响程度,生成特征文本段落的目标多模态特征数据;根据目标多模态特征数据,控制数字人对文本内容进行视频播报,并对数字人的视频内容进行管理,使得数字人视频内容更加生动形象,大大增加了视频内容的吸引力。