LightGBM结果解读:直方图算法与叶生长策略.docxVIP

  • 1
  • 0
  • 约2.02千字
  • 约 7页
  • 2026-07-29 发布于北京
  • 举报

LightGBM结果解读:直方图算法与叶生长策略.docx

LightGBM分类模型结果解读

一、方法概述

LightGBM(LightGradientBoostingMachine)是一种基于梯度提升决策树的高效机器学习算法,由微软研究院提出。该算法通过直方图算法、带深度限制的叶子生长策略等优化策略,显著提升了训练速度和内存效率,特别适用于大规模数据和高维特征的学习任务。本研究利用SPSSAU软件对欺诈检测数据进行LightGBM分类建模分析,旨在通过用户行为特征变量预测欺诈行为的发生,为风险识别提供量化依据。

在SPSSAU【机器学习】模块选择【LightGBM】,将变量拖拽至右侧对应分析框,操作如下图:

二、数据概览

本研究共纳入1000个样本,以换设备次数、支付失败次数、换IP次数、换IP国次数、交易金额5项指标作为自变量,以欺诈标签(0=非欺诈,1=欺诈)作为因变量进行分类建模。因变量分布如下表所示:

由表1可知,1000个样本中非欺诈样本(标签=0)为600例,占比60.00%;欺诈样本(标签=1)为400例,占比40.00%。数据无缺失值,全部纳入分析。样本中非欺诈与欺诈的比例约为3:2,存在一定的类别不平衡现象,但尚未达到极端失衡的程度。

由表2可知,按照8:2的比例将数据划分为训练集和测试集。训练集包含800个样本(占80.00%),用于模型训练;测试集包含200个样本(占20.00%),用于评估模型的泛化能力。无预

文档评论(0)

1亿VIP精品文档

相关文档