- 3
- 0
- 约3.18万字
- 约 10页
- 2026-02-27 发布于北京
- 举报
混合自回归-扩散模型用于实时手语生成
111
MaoxiaoYe,XinfengYe,andManoManoharan
1SchoolofComputerScience,UniversityofAuckland,NewZealand
xye804@aucklanduni.ac.nz,x.ye@auckland.ac.nz,mano.manoharan@auckland.ac.nz
Abstract迫策略——相反,模型依赖于其自身的预测而不是真实
数据,从而避免了训练与推理之间的不一致性。
早期的手语生成(SLP)模型通常依赖于自回归方法,为了有效捕捉手势语姿势的复杂结构,我们采用了
逐个生成输出标记,这本质上提供了时间对齐。虽然像一个多尺度姿态表示模块。该模块将
您可能关注的文档
- 蝎子:解决组织病理学中扫描仪引起的变异问题.pdf
- SALM:具有结构化嵌入的空间音频语言模型用于理解和编辑.pdf
- 生命找到出路:自适应阈值网络中合作结构的涌现.pdf
- ENCOBO: 能量引导的概念瓶颈用于可解释生成.pdf
- 自适应线性约束最小方差框架在体积有源噪声控制中的应用.pdf
- 工程化 RAG 系统用于实际应用:设计、开发和评估.pdf
- KInIT 的 mdok:针对二分类和多分类人工智能生成文本检测的鲁棒微调大语言模型.pdf
- 针对网络物理系统的可持续性攻击生成.pdf
- 阅读后再思考:通过逐步阅读缓解大型语言模型的理解失败问题.pdf
- 混合先验引导网络用于压缩低光照图像增强.pdf
原创力文档

文档评论(0)