本发明公开了局部生成和全局融合的文本驱动三维人体动作生成方法,首先通过大型语言模型将输入文本分解为身体部位的局部描述;然后采用并行扩散模型为各身体部位生成动作潜码,确保局部控制的精确性;再通过空间域融合网络协调各部位动作,形成自然的全身姿态;最后将姿态转换为三维高斯表示,并利用二维扩散模型优化视觉细节,通过高斯溅射实现实时渲染,最终训练完成的网络模型可以实现从文本描述到三维人体动作的端到端生成。本发明解决了现有技术中局部控制不精、全身协调性差及渲染效率低的问题,在动作细节表现、语义对齐和生成效率方面均有显著提升,可广泛应用于虚拟现实、影视游戏制作等领域。
📄 2026102021715
📂 G06T13_40
👤 南京信息工程大学
📅 2026-02-12