基于视觉-语言多模态感知的目标跟踪方法研究.pdfVIP

  • 8
  • 0
  • 约8.85万字
  • 约 65页
  • 2025-10-14 发布于江苏
  • 举报

基于视觉-语言多模态感知的目标跟踪方法研究.pdf

摘要

随着计算机硬件性能的提升和机器学习理论的不断进步,视频目标跟踪在无人驾

驶、视频监控、人机交互等领域呈现出显著的应用前景和重要价值。深度学习的迅速

发展为目标跟踪领域带来了巨大的推动力。然而,任意的跟踪目标和复杂多变的跟踪

场景给目标跟踪带来了巨大的挑战。如何建立强大的目标外观模型成为实现鲁棒跟踪

的关键因素。传统的目标跟踪方法依赖于单一模态目标视觉深度特征进行研究和建模,

但由于目标外观和跟踪场景的多变,在面对相似干扰时往往难以准确定位跟踪目标。

因此,本文主要研究如何在单一视觉模态和视觉-语

文档评论(0)

1亿VIP精品文档

相关文档