基于卷积增强自注意力机制的多场景目标检测方法研究_王嘉炜.pdf

基于卷积增强自注意力机制的多场景目标检测方法研究_王嘉炜.pdf

中文摘要

摘要

随着计算机视觉技术快速发展,多场景目标检测应用需求日益迫切,但现有技

术存在两大核心瓶颈,严重制约检测性能与场景适配能力提升。现有方法在特征建

模过程中表现出两方面的缺陷:一方面,传统ViT依赖大规模数据训练,其固定

位置编码在数据稀缺场景下易引入冗余信息,限制了模型的灵活性与鲁棒性;另一

方面,现有自监督学习未能有效对齐图像级表征与目标级特征,难以捕捉局部细节,

这不仅使预训练参数难以高效迁移,也导致多场景下的

文档评论(0)

1亿VIP精品文档

相关文档