2025多模态大模型驱动下的生成式数字人技术与应用.docxVIP

  • 12
  • 0
  • 约2.36千字
  • 约 20页
  • 2025-11-14 发布于湖南
  • 举报

2025多模态大模型驱动下的生成式数字人技术与应用.docx

2025

传统数字人技术介绍

生成式数字人技术介绍

技术细节与亮点

实验结果分析

生成式数字人结合大语言模型的实时交互

生成式数字人结合音乐生成模型的AI创作

生成式数字人结合商品的视频广告

生成式数字人存在的问题和挑战

生成式数字人开发新范式

方法

基于GAN的算法。通过对抗训练学习,对人物图像的嘴部进行精

准编辑,确保嘴型与输入的语音同步,实现数字人语音播报。

基于NeRF的算法。通过构建神经辐射场对数字人进行个性化建模,提升嘴型生成的自然度、匹配度和语音播报个性化水平。

优势

制作成本低,技术路线短平快。

在特定场景下能达到可接受的效果。

不足

优质的2D数字人应用效果依旧依赖于高

文档评论(0)

1亿VIP精品文档

相关文档