摘要
本发明涉及计算机视觉领域和人工智能领域,本发明公开了基于提示文本的三维图像生成方法、装置、设备及介质,方法包括:通过图像生成模型处理文本,得到图片;将图片进行优化处理,得到深度图和显著性主体图像;根据主体内圈范围从深度图中提取多个深度值;根据零视差面的深度值,生成裁剪边界宽度,采用裁剪边界宽度对左图的左边界进行裁剪,得到裁剪后的左图,采用裁剪边界宽度对右图的右边界进行裁剪,得到裁剪后的右图,裁剪起到对齐主体的作用,对经过裁剪处理的左图和经过裁剪处理的右图进行空洞填补,将填补后的左图和填补后的右图进行合并,生成具备左右视差的三维图像。本发明能提高具备左右视差的三维图像的生成效率。