- 1
- 0
- 约7.4万字
- 约 32页
- 2026-09-10 发布于北京
- 举报
ViT‑P:从局部性重新思考数据高效的视觉
变换器
2022
†???
a王然明迪冯欣重庆理工大学
†加利福尼亚大学
M
4]
.
C
V
8
5
[变换器的进展为计算机视觉任务带来了新的信任。然而,在小数
3
2
cs据集上,变换器难以训练且性能低于卷积神经网络。我们通过引入多焦点
0
.注意偏差,使视觉变换器在数据效率上与卷积神经网络相当。受训练良好
ViT中注意距离的启发,我们约束ViT的自注意机制具有多尺度局部感受野。
原创力文档

文档评论(0)