第三讲:消费响应预测模型PPT课件.ppt

第二讲:消费者响应预测模型;数据挖掘工作意图;数据挖掘工作流程;问题背景;分析;  我们的数据是由更大的客户数据库中用重抽样法抽取的,为了有足够的样本做建模分析,使Dining变量响应值(即为1的值)在样本中的比例近54%,这与现实中客户比例不合。因此,在建模中我们需要调整样本的权重,现实中响应比例是12%。   抽样数据观察记录为1996个,作为统计推断和建模分析精度足够,数据没有缺损值,完整性好。没有太多的齐异数据,基本可认为数据可靠。通过数据的探索分析,可以发现有变量同目标变量存在相关性,因此,可以考虑通过建立目标变量与其它变量的回归模型、决策树模型和神精网络模型来预测目标变量。;创建数据挖掘项目;项目管理窗;流程图;  数据挖掘的第一步就是确定样本数据,数据的角色,变量的模型中角色和数据类型。一般来说,用户数据仓库中的数据可能是海量的,如果全部用来建模分析,则运算十分耗时。只要我们才取好的抽样方式,抽取几百样本就足够保证统计推断精度,因此,第一步要抽取样本。   另外,为建模需要,我们要确定数据角色,即训练集用来拟合模型;效验集用来检验模型误差,以便减少过度拟合情况,增加模型的稳建性;测试集用来得到模型参数的一致有效估计无偏估计;得分集作为待预测的数集,应该没有响应变量的值。我们要事先确定数据角色。   变量的模型角色分为目标变量、输入变量、时间变量和标识变量,在建模之前必

您可能关注的文档

文档评论(0)

1亿VIP精品文档

相关文档