- 2
- 0
- 约1.2万字
- 约 13页
- 2023-04-22 发布于四川
- 举报
本发明公开了一种基于局部密度信息的软件缺陷数据自适应过采样方法,本发明首先在数据预处理阶段使用Min‑Max归一化方法统一量纲,使用提出的AgglomerativeClustering‑Relief特征选择方法,降低数据维度并删除冗余特征。然后在自适应分组采样阶段,通过分析在低维状态下的少数类实例的局部密度信息,将所有少数类实例根据各自的分布特点划分至不同的分组,并针对不同分组中的少数类实例,采用针对性的过采样策略进行自适应过采样。最终使数据集中两类样本数量达到平衡,从数据层面解决不平衡问题。
(19)中华人民共和国国家知识产权局
(12)发明专利申请
(10)申请公布号 CN 113936185 A
(43)申请公布日 2022.01.14
(21)申请号 202111116252.7 G06K 9/62 (2022.01)
(22)申请日 20
原创力文档

文档评论(0)