极端随机树结果解读:高随机化的集成分类模型.docxVIP

  • 1
  • 0
  • 约1.82千字
  • 约 6页
  • 2026-07-31 发布于北京
  • 举报

极端随机树结果解读:高随机化的集成分类模型.docx

极端随机树分类模型结果解读

一、方法概述

极端随机树(ExtraTrees,ExtremelyRandomizedTrees)是一种集成学习方法,通过构建多棵极度随机化的决策树来提高模型的泛化能力和稳定性。与随机森林不同,极端随机树在节点分裂时不仅随机选择特征子集,还随机选择分裂点,这种额外的随机性有助于进一步降低方差、提升模型的鲁棒性。本研究利用SPSSAU软件对欺诈检测数据进行极端随机树分类建模分析,以评估该方法在欺诈识别任务中的有效性。

在SPSSAU【机器学习】模块选择【极端随机树】,将变量拖拽至右侧对应分析框,操作如下图:

二、数据概览

本研究共纳入1000个样本,以换设备次数、支付失败次数、换IP次数、换IP国次数、交易金额5项指标作为自变量,以欺诈标签(0=非欺诈,1=欺诈)作为因变量进行分类建模。因变量分布如下表所示:

由表1可知,1000个样本中非欺诈样本(标签=0)为600例,占比60.00%;欺诈样本(标签=1)为400例,占比40.00%。数据无缺失值,全部纳入分析。

由表2可知,按照8:2的比例将数据划分为训练集(800个样本,占80.00%)和测试集(200个样本,占20.00%),用于模型训练与泛化能力评估。

三、特征权重分析

由表3可知,极端随机树模型的特征权重分布呈现出以行为特征为主导的格局。换设备次数的权重最高,为0.260(26.00%)

文档评论(0)

1亿VIP精品文档

相关文档