基于提示文本的三维图像生成方法、装置、设备及介质

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
基于提示文本的三维图像生成方法、装置、设备及介质
申请号:CN202511035218
申请日期:2025-07-25
公开号:CN120526067B
公开日期:2025-11-04
类型:发明专利
摘要
本发明涉及计算机视觉领域和人工智能领域,本发明公开了基于提示文本的三维图像生成方法、装置、设备及介质,方法包括:通过图像生成模型处理文本,得到图片;将图片进行优化处理,得到深度图和显著性主体图像;根据主体内圈范围从深度图中提取多个深度值;根据零视差面的深度值,生成裁剪边界宽度,采用裁剪边界宽度对左图的左边界进行裁剪,得到裁剪后的左图,采用裁剪边界宽度对右图的右边界进行裁剪,得到裁剪后的右图,裁剪起到对齐主体的作用,对经过裁剪处理的左图和经过裁剪处理的右图进行空洞填补,将填补后的左图和填补后的右图进行合并,生成具备左右视差的三维图像。本发明能提高具备左右视差的三维图像的生成效率。
技术关键词
三维图像生成方法 图像生成模型 深度值 文本 深度图 图片 三维图像生成装置 尺寸 像素点 基准 元素 语义 电子设备 可读存储介质 星形结构 空洞 立体视觉 处理器 计算机视觉