基于自训练与伪标签细化的半监督语义分割中的类别平衡与确认偏差研究综述.docVIP

  • 1
  • 0
  • 约3.71千字
  • 约 4页
  • 2026-09-30 发布于江苏
  • 举报

基于自训练与伪标签细化的半监督语义分割中的类别平衡与确认偏差研究综述.doc

基于自训练与伪标签细化的半监督语义分割中的类别平衡与确认偏差研究综述

一、半监督语义分割领域的自训练与伪标签技术演进

半监督语义分割(Semi-SupervisedSemanticSegmentation,S4)作为缓解像素级标注成本瓶颈的核心技术路径,近年来已从传统的一致性正则化主导范式,逐步转向自训练(Self-Training)与伪标签(Pseudo-Labeling)技术为核心的第二发展阶段。自训练框架的核心逻辑是利用少量标注数据训练初始教师模型,对大量无标注数据生成伪标签,再将混合标注数据用于学生模型训练,通过多轮迭代实现性能增益。早期自训练方法如2019年提出的Self-TrainingwithEntropyMinimization首次验证了该范式在PascalVOC数据集上的有效性,仅使用1/8标注数据即可达到全监督模型90%的性能。

伪标签质量是决定自训练性能上限的核心因素,因此伪标签细化技术成为近五年研究的焦点。第一代伪标签细化策略聚焦置信度过滤机制,通过设定固定阈值(如0.9)保留模型预测置信度高于阈值的像素伪标签,直接丢弃低置信度区域。这类方法简单高效,但存在严重的信息损失问题:在Cityscapes等包含大量小目标(如交通灯、警示牌)的数据集上,小类别像素的预测置信度普遍低于阈值,导致90%以上的小类别伪标签被过滤,进一步加剧训练过程中的类别失

您可能关注的文档

文档评论(0)

1亿VIP精品文档

相关文档