摘要
本发明提供了一种基于文本引导的三维可驱动人体生成与编辑方法,包括:步骤1,通过使用大语言模型,对多视图人体数据集进行标注;步骤2,构建UV对齐的3D高斯数字人表征方式;步骤3,构建结构化隐空间并训练小型自解码器;步骤4,实现文本引导的结构化隐空间生成;步骤5,对已经生成的3D高斯数字人对应的隐空间特征进行重绘制,得到新文本描述对应的隐空间特征,通过训练好的小型自解码器将新文本描述对应的隐空间特征解码为新文本描述对应的3D高斯数字人,实现对3D高斯数字人的编辑。本发明提出了一个新颖的框架来拟合结构化三维人体数据的分布,并实现文本引导的三维人体生成与编辑。