一种基于二维图像联合先验的文本到3D模型生成方法

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
一种基于二维图像联合先验的文本到3D模型生成方法
申请号:CN202510922993
申请日期:2025-07-04
公开号:CN120747373A
公开日期:2025-10-03
类型:发明专利
摘要
本发明提供了一种基于二维图像联合先验的文本到3D模型生成方法,包括:S1.二维图像生成;S2.图像信息与文本联合嵌入:通过图像编码器提取二维图像的全局嵌入,同时获取文本提示信息的文本嵌入,二者维度一致;S3.图像联合先验的分数蒸馏采样;S4.损失增益优化;S5.视角匹配增强。本发明方法解决了文本到3D模型生成过程中出现的失真以及视角不一致问题,可以满足应用于不同场景下的设计和资产化需求;通过将图像信息联合文本提示信息,图像嵌入与文本嵌入特征对齐联合先验,能够实现兼顾模型的语义表达和视觉细节,能够有效提升3D模型生成的质量和效率。
技术关键词
模型生成方法 文本 高分辨率纹理 视觉特征提取 图像编码器 蒸馏 图像嵌入 嵌入特征 语义 阶段 分层次 噪声 多视角 网格 基元 资产 相机