XGBoost结果解读:学习率与正则化参数的调优.docxVIP

  • 1
  • 0
  • 约2.18千字
  • 约 7页
  • 2026-07-29 发布于北京
  • 举报

XGBoost结果解读:学习率与正则化参数的调优.docx

XGBoost分类模型结果解读

一、方法概述

XGBoost(eXtremeGradientBoosting)是一种高效的梯度提升算法,通过迭代训练弱分类器(通常为决策树)并集成它们的预测结果来构建强大的分类模型。该算法引入了正则化项(包括L1和L2正则化)以控制模型复杂度,有效防止过拟合,同时提供了灵活的特征重要性评估机制。本研究利用SPSSAU软件对欺诈检测数据进行XGBoost分类建模分析,旨在通过用户行为特征变量预测欺诈行为,为风险识别提供科学依据。

在SPSSAU【机器学习】模块选择【XGBoost】,将变量拖拽至右侧对应分析框,操作如下图:

二、数据概览

本研究共纳入1000个样本,以换设备次数、支付失败次数、换IP次数、换IP国次数、交易金额5项指标作为自变量,以欺诈标签(0=非欺诈,1=欺诈)作为因变量进行分类建模。因变量分布如下表所示:

由表1可知,1000个样本中非欺诈样本(标签=0)为600例,占比60.00%;欺诈样本(标签=1)为400例,占比40.00%。数据无缺失值,全部纳入分析。

由表2可知,按照8:2的比例将数据划分为训练集(800个样本,占80.00%)和测试集(200个样本,占20.00%),用于模型训练与泛化能力评估。

三、特征权重分析

由表3可知,XGBoost模型的特征权重分布呈现出高度集中于行为特征的模式。换设备次数的权重最高,为0

文档评论(0)

1亿VIP精品文档

相关文档