GBDT梯度提升树结果解读:迭代拟合与变量重要性.docxVIP

  • 2
  • 0
  • 约1.94千字
  • 约 7页
  • 2026-07-29 发布于北京
  • 举报

GBDT梯度提升树结果解读:迭代拟合与变量重要性.docx

GBDT分类模型结果解读

一、方法概述

GBDT(GradientBoostingDecisionTree)是一种基于决策树的集成学习算法,通过将多个弱分类器(回归树)进行迭代加权来提升模型的预测准确性。在每一次迭代中,GBDT根据上一轮模型的预测结果计算残差,并将残差作为下一轮模型的训练目标,逐步减小预测误差。本研究利用SPSSAU软件对欺诈检测数据进行GBDT分类建模分析,以评估该方法在欺诈识别任务中的有效性。

在SPSSAU【机器学习】模块选择【GBDT】,将变量拖拽至右侧对应分析框,操作如下图:

二、数据概览

本研究共纳入1000个样本,以换设备次数、支付失败次数、换IP次数、换IP国次数、交易金额5项指标作为自变量,以欺诈标签(0=非欺诈,1=欺诈)作为因变量进行分类建模。因变量分布如下表所示:

由表1可知,1000个样本中非欺诈样本(标签=0)为600例,占比60.00%;欺诈样本(标签=1)为400例,占比40.00%。数据无缺失值,全部纳入分析。

由表2可知,按照8:2的比例将数据划分为训练集(800个样本,占80.00%)和测试集(200个样本,占20.00%),用于模型训练与泛化能力评估。

三、特征权重分析

由表3可知,GBDT模型的特征权重分布以行为特征为主导。换设备次数的权重最高,为0.325(32.53%),对模型构建起关键作用。换IP国次数位居第二

您可能关注的文档

文档评论(0)

1亿VIP精品文档

相关文档