摘要
本申请提供了一种虚拟角色对话方法、装置、存储介质及电子设备,可根据虚拟对话上下文和第一内容属性,生成目标图像描述文本,使得目标图像描述文本能够同时反映虚拟对话上下文中涉及的图像内容属性及基础角色图像中涉及的图像内容属性。在得到目标图像描述文本后,本申请可利用语义检索技术和图文检索技术,在历史图像库中进行图像检索,以尝试得到与虚拟对话上下文和基础角色图像相契合的目标历史角色图像,并以此作为对话应答图像返回至对话中。如此,既可确保对话应答图像与对话场景高度契合,又能充分利用历史图像库,以快速提供对话应答图像,满足实时交互需求。由此可见,本申请可在对话中快速提供与对话场景高度契合的应答图像。