摘要
随着互联网及人工智能等高新技术的发展,多模态数据在信息传播中的地位
日益重要,视觉问答作为典型的融合多模态人工智能任务得到了广泛的关注。众
所周知,在深度学习领域合适的训练策略对于模型的成功训练和性能优化至关重
要,并且由于多模态问答任务的特殊性,训练策略对视觉问答模型性能的影响尤
为突出。一方面是因为来自不同模态的图像与问题之间天然的存在着语义鸿沟,
这阻碍了图像与问题中相同语义信息间的直接交互,从而存在语言先验以及答非
所问的情况,另一方面视觉问答任务数据分布的不均衡,导致模型学习偏差,对
您可能关注的文档
最近下载
- 文学革命论_原创文档.pdf VIP
- 2026年正精算师再保险精算建模实操卷.docx
- 22S521预制装配式混凝土检查井.docx VIP
- GB 50747-2024 中文版 电子工业纯水系统设计规范(2024 修订版).docx VIP
- 聚焦《塔林手册》透视网络战规则.pdf VIP
- 计算机系统的组成PPT(共45张PPT).pptx VIP
- 湖心亭看雪-王崧舟.ppt
- 《丙烯酸地面施工技术标准》(征求意见稿).docx
- 2026年海南省中考地理试题卷(含答案及解析).docx
- 宣贯培训(2026年)《JBT 13813.5-2020滚动功能部件可靠性与寿命 第5部分:滚动直线导轨副精度保持性试验规范》.pptx VIP
原创力文档

文档评论(0)