一种基于文本引导优化的三维感知头像精细化表情编辑方法
申请号:CN202510991845
申请日期:2025-07-18
公开号:CN120931872A
公开日期:2025-11-11
类型:发明专利
摘要
本发明提供的是一种基于文本引导优化的三维感知头像精细化表情编辑方法,包括3大核心模块:基础合成网络模块、双重映射器模块和文本引导优化模块。双重映射器模块用于三维头像精细化表情编辑,其核心在于包含一个纹理映射器和一个情感映射器,并通过交叉注意力机制实现对纹理隐空间和几何表情空间的协同、交互式优化。文本引导优化模块利用预训练的CLIP模型,将自然语言文本作为监督信号,从而在无需大规模精细化标注数据集的情况下,实现对双重映射器模块的有效训练。该方法具有提升精细化表情控制精度、解决数据稀缺并保证编辑方向正确、解耦身份与表情的同时保证身份保真度等优点。
技术关键词
表情编辑方法
头像
交叉注意力机制
参数
身份
自然语言文本
纹理
图像
编码器
传播算法
网络模块
核心
数据
人脸